Июль 2026   |   В фокусе

Anthropic представила Claude Opus 5: вдвое дешевле и мощнее для бизнеса

Модель Claude Opus 5 от Anthropic удваивает производительность при сохранении цены, делая сложные задачи по аналитике и программированию доступными для массового внедрения. Это изменение экономики ИИ позволяет бизнесу автоматизировать процессы, которые ранее были нерентабельны из-за высокой стоимости токенов.

Компания Anthropic запустила новую модель Claude Opus 5, которая предлагает уровень интеллекта, близкий к флагману Claude Fable 5, но стоит в два раза дешевле. Модель доступна сразу на всех платформах и уже стала стандартной для тарифа Claude Max, а также самой мощной для Claude Pro. Ключевое отличие — способность выполнять сложные задачи по программированию и аналитике с высокой точностью, при этом генерируя меньше токенов и работая быстрее предшественника Opus 4.8.

Важный нюанс: Снижение стоимости при росте производительности меняет экономику внедрения ИИ: задачи, которые ранее были нерентабельны из-за цены токенов, теперь становятся доступными для массового использования в бизнес-процессах.

Производительность и экономическая эффективность

Новая модель демонстрирует значительный рост эффективности на специализированных тестах. На бенчмарке Frontier-Bench v0.1 по инженерным задачам Opus 5 обошел все существующие модели, удвоив результат Opus 4.8 при меньших затратах. В тестах на автоматизацию бизнес-процессов (Zapier AutomationBench) модель показывает прохождение задач в 1,5 раза чаще конкурентов при той же стоимости.

В области работы с компьютером (OSWorld 2.0) Opus 5 превосходит даже Fable 5 по соотношению цены и качества, достигая лучших результатов за треть стоимости. Для научных исследований, особенно в органической химии и биоинформатике, точность выросла на 10,2 и 7,7 процентных пункта соответственно по сравнению с предыдущей версией.

Ключевые показатели эффективности:

  • Frontier-Bench v0.1: Лучший результат среди всех моделей, более чем двукратный рост производительности относительно Opus 4.8.
  • CursorBench 3.2: Отставание от Fable 5 составляет менее 0,5%, но стоимость задачи в два раза ниже.
  • ARC-AGI 3: Результат в 3 раза выше, чем у ближайшего конкурента.
  • Визуализация: Модель способна создавать сложные интерактивные иллюстрации, например, моделировать аэродинамические потоки или строить интерактивные схемы клеток.

Стоит учесть: Модель не просто ускоряет работу, а меняет подход к решению задач: она способна самостоятельно создавать инструменты для проверки своих результатов, что снижает потребность в ручном контроле разработчиков.

Практическое применение и автономность

Пользователи отмечают, что Opus 5 ведет себя как ответственный специалист: он проверяет свои действия, итеративно дорабатывает решения и не спешит с выводами. В реальных кейсах модель самостоятельно написала код для компьютерного зрения, чтобы «увидеть» чертеж детали, который ей не показали напрямую, и восстановила 3D-модель. В другом случае она нашла и устранила скрытую ошибку в популярном пакете управления, которую пропустили другие модели.

В финансовой и юридической сферах точность выросла на 9 процентных пунктов, а время выполнения задач сократилось на 60%. Модель эффективно работает с таблицами, проводит дью-дилидженс и анализирует данные, выявляя ошибки в коде и логике, которые ранее требовали ручного вмешательства.

Примеры использования в бизнесе:

  • Разработка: Создание полноценных фидов рыночных данных и тестовых окружений за одну сессию.
  • Юриспруденция: Подготовка поправок к документам (redlines) в два раза быстрее с сохранением точности.
  • Торговля: Анализ торговых стратегий с использованием в 7 раз меньше токенов рассуждений и при задержке ниже, чем у Opus 4.8.
  • Научные исследования: Проведение статистических тестов и перепроверка результатов независимыми методами.

Безопасность и ограничения

Anthropic подчеркивает, что Opus 5 — самая безопасная модель в линейке. В тестах на соответствие правилам (Claude Constitution) она показала лучший результат, минимизируя риски обмана и нежелательных действий. Однако модель не является лидером в задачах кибербезопасности и биологии: здесь она уступает специализированной модели Mythos 5.

Разработчики намеренно не обучали Opus 5 на задачах по взлому. Хотя модель хорошо находит уязвимости в коде, она значительно уступает Mythos 5 в создании эксплойтов (инструментов для атаки). Для защиты от злоупотреблений внедрены строгие фильтры:

  • Разрешен поиск уязвимостей в исходном коде.
  • Заблокированы сканирование бинарных файлов, пентесты и генерация эксплойтов.
  • При срабатывании фильтров запрос автоматически перенаправляется на Opus 4.8.

Для исследователей и компаний, работающих в сфере кибербезопасности, доступен Cyber Verification Program (CVP), который предоставляет версию модели с ослабленными ограничениями. В биологических исследованиях модель также имеет ограничения на автономные долгосрочные эксперименты, где риски остаются высокими.

Важный нюанс: Безопасность модели строится на компромиссе: она способна находить ошибки, но лишена возможности использовать их для атаки, что делает её безопасным инструментом для аудита кода, но не для пентестинга без специального разрешения.

Условия запуска и доступность

Модель доступна с 24 июля 2026 года. Стоимость использования составляет $5 за миллион входных токенов и $25 за миллион выходных токенов, что совпадает с ценой Opus 4.8. Также доступен режим Fast, работающий в 2,5 раза быстрее, но вдвое дороже базовой версии.

Для разработчиков введены новые функции:

  • Возможность менять доступные инструменты в ходе диалога без сброса кэша.
  • Автоматическое переключение на другую модель при срабатывании фильтров безопасности через API.

Данные о запросах не хранятся для общего доступа, что соответствует политике конфиденциальности предыдущих версий.

На фоне этого: Одинаковая цена при двукратном росте производительности делает Opus 5 экономически выгодным выбором для миграции с предыдущих версий, позволяя бизнесу перераспределить бюджет на другие задачи.

Коротко о главном

Почему Opus 5 считается экономически выгоднее флага Claude Fable 5?

Модель предлагает уровень интеллекта, близкий к Fable 5, но стоит в два раза дешевле, что сделало нерентабельные ранее задачи доступными для массового внедрения в бизнес-процессы.

Как Opus 5 изменила результаты тестов на инженерные задачи Frontier-Bench v0.1?

Модель удвоила результат по сравнению с Opus 4.8 и обошла все существующие аналоги, достигнув лучших показателей при меньших затратах ресурсов.

В чем заключается преимущество Opus 5 в тестах на автоматизацию Zapier AutomationBench?

При той же стоимости модель проходит задачи в 1,5 раза чаще конкурентов, демонстрируя высокую эффективность в автоматизации бизнес-процессов.

Почему Opus 5 уступает модели Mythos 5 в задачах кибербезопасности?

Разработчики намеренно не обучали модель на создании эксплойтов и заблокировали генерацию инструментов для атаки, чтобы минимизировать риски злоупотреблений, что привело к отставанию в специализированных тестах на взлом.

Как модель реагирует на запросы, нарушающие правила безопасности?

При срабатывании фильтров на сканирование бинарных файлов или пентесты запрос автоматически перенаправляется на более старую версию Opus 4.8, чтобы предотвратить выполнение опасных действий.

Какой эффект дала Opus 5 в финансовых и юридических сферах?

Точность работы выросла на 9 процентных пунктов, а время выполнения задач сократилось на 60%, что позволило модели самостоятельно выявлять ошибки в логике и коде без ручного вмешательства.

Почему для исследователей кибербезопасности создан отдельный Cyber Verification Program (CVP)?

Стандартная версия имеет строгие ограничения на создание эксплойтов, поэтому программа CVP предоставляет доступ к модели с ослабленными фильтрами для легитимного аудита и тестирования уязвимостей.

Инфографика событий

Открыть инфографику на весь экран


Участники и связи

Отрасли: ИТ и программное обеспечение; Искусственный интеллект (AI); Кибербезопасность; ПО и разработка

Материалы по теме