ИИ агенты: Новые тесты ставят под сомнение их готовность к работе

Новое исследование выявило значительные недостатки ИИ моделей при выполнении офисных задач, ставя под вопрос их готовность к работе.

Искусственный интеллект, работающий с документами, демонстрирующий концепцию ИИ агента

Актуальные исследования TechCrunch показывают, что ведущие модели ИИ демонстрируют неожиданно низкие результаты при выполнении реальных «беловоротничковых» задач. Эксперименты включали задания из сфер консалтинга, инвестиционного банкинга и юриспруденции.

Согласно отчету, большинство протестированных ИИ моделей не смогли эффективно справиться с предложенными задачами, что вызывает вопросы относительно их текущей пригодности для интеграции в профессиональную рабочую среду. Это может сигнализировать о необходимости дальнейших доработок перед массовым внедрением.