ИИ агенты: Новые тесты ставят под сомнение их готовность к работе
Новое исследование выявило значительные недостатки ИИ моделей при выполнении офисных задач, ставя под вопрос их готовность к работе.
Актуальные исследования TechCrunch показывают, что ведущие модели ИИ демонстрируют неожиданно низкие результаты при выполнении реальных «беловоротничковых» задач. Эксперименты включали задания из сфер консалтинга, инвестиционного банкинга и юриспруденции.
Согласно отчету, большинство протестированных ИИ моделей не смогли эффективно справиться с предложенными задачами, что вызывает вопросы относительно их текущей пригодности для интеграции в профессиональную рабочую среду. Это может сигнализировать о необходимости дальнейших доработок перед массовым внедрением.