Anthropic выпустила Claude Opus 5: ИИ для бизнеса
Anthropic представила Claude Opus 5 — более дешёвую модель ИИ. Она предлагает почти все возможности Claude Fable 5, но вдвое дешевле, что важно для бизнеса.
Anthropic представила Claude Opus 5 в пятницу, 24 июля 2026 года. Эта ИИ-модель, по заявлению компании, предлагает почти всю интеллектуальную мощь флагманской Claude Fable 5, но за вдвое меньшую стоимость. Запуск Opus 5 показывает, что гонка ИИ смещается от чистых возможностей к экономической эффективности повседневного использования.
Модель уже доступна на всех платформах Anthropic. Её цена осталась прежней по сравнению с предшественником Opus 4.8: $5 за миллион входных токенов и $25 за миллион выходных токенов. Opus 5 стала новой моделью по умолчанию для Claude Max, премиального потребительского уровня Anthropic, и самой мощной моделью, доступной на Claude Pro.
Anthropic не называет Opus 5 своей самой умной моделью; это место занимает Fable 5. Компания делает акцент на экономическую выгоду для корпоративных клиентов. Основная часть важной работы с ИИ находится в среднем диапазоне сложности, где эффективный и недорогой ИИ почти на уровне передовых систем превосходит дорогой флагманский ИИ. Представитель Anthropic описал позиционирование моделей так: Opus 5 — для повседневной сложной работы; Fable 5 — для самых амбициозных, многодневных автономных проектов; Sonnet 5 — для масштабируемых задач; Haiku 4.5 — для субагентов и мгновенных ответов.
Результаты тестов Opus 5 впечатляют. Anthropic заявляет, что модель установила новые рекорды в оценках кодирования и интеллектуальной работы, включая Frontier-Bench и GDPval-AA. На Frontier-Bench v0.1 Opus 5 набрала 43.3%, что более чем вдвое превышает 18.7% у Opus 4.8 и значительно опережает 33.7% у Fable 5, при этом стоимость задачи ниже. В тесте ARC-AGI 3 Opus 5 показала результат в три раза выше, чем следующая лучшая модель. На OSWorld 2.0 модель превзошла лучший результат Fable 5, но с затратами всего в треть от её стоимости.
Компания честно признаёт ограничения Opus 5. Модель уступает конкурирующей Mythos 5 в задачах кибербезопасности и биологических исследованиях. Одна из моделей семейства OpenAI также лидирует в одном из тестов агентского кодирования. Anthropic также объяснила, в чём Opus 5 уступает Fable 5. Представитель компании отметил, что тесты, где Opus 5 побеждает, — это ограниченные задачи с конкретным результатом. Эти тесты не измеряют длительность работы. Opus 5 — лучший инструмент для задач, которые видят бенчмарки, а Fable 5 нужна, когда задача выходит за рамки теста. Fable 5 предназначена для самых долгих, автономных задач, где модель должна сохранять связность на протяжении многих связанных шагов в течение часов или дней с большим объёмом исходных данных.
Ключевая идея запуска — эффективность Opus 5 не только в результатах, но и в стоимости. Модель имеет настраиваемый параметр "усилия", позволяющий клиентам менять интеллект на скорость и экономию токенов. Anthropic подчёркивает производительность при заданной стоимости. Ранние клиенты подтверждают это. Harvey сообщила, что Opus 5 достигла схожей производительности с режимом максимального рассуждения Opus 4.8, но генерировала на 26% меньше токенов. Ричард Фам из Fundamental Research Lab отметил, что в сложных задачах финансового моделирования модель показала на 9 процентных пунктов более высокую точность, используя примерно на треть меньше итераций и вызовов инструментов, а также на 60% меньше времени. Уэйд Фостер, глава Zapier, заявил, что Opus 5 возглавила их таблицу лидеров AutomationBench, не расходуя больше токенов. Скотт Ву, глава Cognition, сказал, что на FrontierCode 1.1 Claude Opus 5 приближается к производительности Fable за половину стоимости, особенно сильна в отладке и анализе первопричин.
Акцент на эффективности отражает коммерческую реальность. Расходы на корпоративный ИИ больше не являются экспериментальными, а затраты на инференс стали важной статьёй бюджета. Бизнес Anthropic сильно ориентирован на API и корпоративное использование. По данным Contrary Research, Claude занимал около 40% рынка больших языковых моделей для предприятий к концу 2025 года. Только Claude Code достиг примерно $1 миллиарда годового дохода. Для компании, чьи клиенты платят за токены, модель, которая делает больше с меньшим количеством токенов, — это сам продукт.
Anthropic также продвигает идею, что Opus 5 проверяет свою работу и итерирует до достижения успеха. Компания привела несколько примеров. В одной задаче Frontier-Bench модель должна была восстановить деталь как 3D CAD-модель по чертежу, который ей намеренно не дали просмотреть. Вместо того чтобы потерпеть неудачу, Opus 5 написала собственный конвейер компьютерного зрения для извлечения геометрии из необработанных пикселей. В другом случае, столкнувшись с реальной ошибкой в популярном менеджере пакетов, модель нашла первопричину и исправила крайний случай, который пропустил патч сообщества. Инженер торговой фирмы использовал Opus 5 для создания потока рыночных данных для новой биржи. Не найдя живого потока для проверки, модель построила собственный тестовый стенд для проверки своего кода парсинга. Кристиан Ривера из Stripe рассказал, что дал модели "роль начальника штаба" над своими средами разработки на выходные: она построила собственный монитор, управляла каждым блоком и обращалась к нему только для принятия решений.
Запуск также демонстрирует сложный подход Anthropic к безопасности. Компания намеренно не обучает свои модели определённым навыкам. Автоматический аудит поведения показал, что Opus 5 — самая выровненная модель на сегодняшний день, набрав 2.3 балла по общему несовместимому поведению. Это ниже, чем у Opus 4.8, Sonnet 5 или Fable 5. Anthropic намеренно не обучала Opus 5 киберзадачам. Модель всё равно улучшилась в них благодаря общим улучшениям возможностей. Сейчас она почти соответствует Mythos 5 в поиске уязвимостей программного обеспечения. Однако она значительно отстаёт в их эксплуатации: в тесте OSS-Fuzz Opus 5 выявила уязвимости с вероятностью 79.4%, но успешно разработала эксплойты только в 4 задачах против 13 у Mythos 5. Эта асимметрия — сильная сторона в обнаружении, связанном с защитой, и слабая сторона в эксплуатации, связанной с нападением — кажется преднамеренной. Защитные механизмы следуют той же логике. Anthropic ожидает, что кибер-классификаторы Opus 5 будут срабатывать примерно на 85% реже, чем у Fable 5.
Если классификатор срабатывает, запросы в Claude.ai, Claude Code и Claude Cowork по умолчанию перенаправляются на Opus 4.8. Представитель компании объяснил, что модель, на которую происходит переключение, имеет более низкий уровень возможностей, что снижает риск вредоносного использования. Пользователь получает сообщение об этом. Эта логика оправдана, но она показывает, как работает безопасность ИИ сейчас: риск — это не только свойство вопроса, но и свойство вопроса, умноженное на возможности системы, отвечающей на него. В области биологии Opus 5 — самая мощная общедоступная модель Anthropic для научных исследований, набравшая на 10.2 процентных пункта больше, чем Opus 4.8, во внутреннем тесте по химии. Однако Mythos 5 остаётся более сильной моделью для долгосрочных, открытых задач, таких как автономное проектирование лекарств.
Запуск происходит в момент значительного коммерческого роста и обязательств для Anthropic. Reuters сообщал в феврале, что компания была оценена примерно в $380 миллиардов в последнем раунде финансирования. Годовой доход вырос с примерно $1 миллиарда в конце 2024 года до прогнозируемых $9 миллиардов к концу 2025 года, с внутренними целями в $20-26 миллиардов на 2026 год. Эти цели подкреплены огромными инвестициями в инфраструктуру, включая сделку с Azure на $30 миллиардов, а также соглашения с Google Cloud и Nvidia. Эти расходы окупятся, только если предприятия продолжат расширять использование ИИ. В этом контексте ценовая стратегия Opus 5 имеет смысл. Сохранение цены на уровне Opus 4.8 при удвоении производительности по ключевым агентским тестам фактически является значительным снижением цены за единицу возможностей. Это сделано для расширения спектра рабочих нагрузок, которые экономически выгодно автоматизировать.
Регуляторная обстановка также усложнилась. Судья США окончательно одобрил урегулирование Anthropic на $1.5 миллиарда с авторами книг по поводу данных для обучения. В июне Reuters, ссылаясь на Axios, сообщил, что правительство США заблокировало иностранный доступ к самым передовым моделям Anthropic. Это напоминание, что передовой ИИ теперь связан с экспортной политикой.
В пятницу также вышли: режим Fast, работающий примерно в 2.5 раза быстрее по двойной базовой цене; автоматическая маршрутизация отката в API; изменения инструментов в середине разговора, которые больше не аннулируют кэш запросов. Последняя функция может быть оценена разработчиками агентов больше, чем любой бенчмарк. Как и предыдущие модели Opus, Opus 5 не имеет требований к хранению данных для общего доступа. Разработчики могут получить доступ к модели как claude-opus-5 через Claude API уже сегодня.
Два вопроса определят успех: подтвердятся ли заявления об эффективности Opus 5 в реальных производственных нагрузках и примут ли предприятия мир, где классификаторы безопасности, а не пользователи, иногда решают, какая модель отвечает. Главное послание запуска в том, что центр тяжести ИИ-индустрии сместился. Три года лаборатории соревновались в том, что их лучшая модель могла сделать в свой лучший день. С Opus 5 Anthropic конкурирует в чём-то менее гламурном, но гораздо более прибыльном: что очень хорошая модель может делать каждый день за половину цены. На рынке, где граница постоянно движется, Anthropic ставит на то, что настоящее богатство лежит сразу за ней.