Сколько ИИ нужно, чтобы прочитать PDF? Оказывается, порой и множество систем не справятся с этой задачей. Ноябрь прошлого года принёс интересный, хотя и показательный, случай, когда искусственный интеллект столкнулся с серьёзными трудностями.
Комитет по надзору Палаты представителей США выпустил 20 000 страниц документов из архива Джеффри Эпштейна. Группа исследователей во главе с Люком Айгелом попыталась использовать ИИ для анализа этих данных, включая запутанные переписки и объёмные PDF-файлы. Однако система не справилась с задачей, демонстрируя ограничения в обработке и понимании сложноструктурированных документов. Это подчёркивает, что несмотря на быстрый прогресс, у ИИ ещё есть куда расти в вопросах контекстного анализа и работы с 'грязными' данными.









