Anthropic представила Claude Opus 5: вдвое дешевле и мощнее для бизнеса
Модель Claude Opus 5 от Anthropic удваивает производительность при сохранении цены, делая сложные задачи по аналитике и программированию доступными для массового внедрения. Это изменение экономики ИИ позволяет бизнесу автоматизировать процессы, которые ранее были нерентабельны из-за высокой стоимости токенов.
Компания Anthropic запустила новую модель Claude Opus 5, которая предлагает уровень интеллекта, близкий к флагману Claude Fable 5, но стоит в два раза дешевле. Модель доступна сразу на всех платформах и уже стала стандартной для тарифа Claude Max, а также самой мощной для Claude Pro. Ключевое отличие — способность выполнять сложные задачи по программированию и аналитике с высокой точностью, при этом генерируя меньше токенов и работая быстрее предшественника Opus 4.8.
Важный нюанс: Снижение стоимости при росте производительности меняет экономику внедрения ИИ: задачи, которые ранее были нерентабельны из-за цены токенов, теперь становятся доступными для массового использования в бизнес-процессах.
Производительность и экономическая эффективность
Новая модель демонстрирует значительный рост эффективности на специализированных тестах. На бенчмарке Frontier-Bench v0.1 по инженерным задачам Opus 5 обошел все существующие модели, удвоив результат Opus 4.8 при меньших затратах. В тестах на автоматизацию бизнес-процессов (Zapier AutomationBench) модель показывает прохождение задач в 1,5 раза чаще конкурентов при той же стоимости.
В области работы с компьютером (OSWorld 2.0) Opus 5 превосходит даже Fable 5 по соотношению цены и качества, достигая лучших результатов за треть стоимости. Для научных исследований, особенно в органической химии и биоинформатике, точность выросла на 10,2 и 7,7 процентных пункта соответственно по сравнению с предыдущей версией.
Ключевые показатели эффективности:
- Frontier-Bench v0.1: Лучший результат среди всех моделей, более чем двукратный рост производительности относительно Opus 4.8.
- CursorBench 3.2: Отставание от Fable 5 составляет менее 0,5%, но стоимость задачи в два раза ниже.
- ARC-AGI 3: Результат в 3 раза выше, чем у ближайшего конкурента.
- Визуализация: Модель способна создавать сложные интерактивные иллюстрации, например, моделировать аэродинамические потоки или строить интерактивные схемы клеток.
Стоит учесть: Модель не просто ускоряет работу, а меняет подход к решению задач: она способна самостоятельно создавать инструменты для проверки своих результатов, что снижает потребность в ручном контроле разработчиков.
Практическое применение и автономность
Пользователи отмечают, что Opus 5 ведет себя как ответственный специалист: он проверяет свои действия, итеративно дорабатывает решения и не спешит с выводами. В реальных кейсах модель самостоятельно написала код для компьютерного зрения, чтобы «увидеть» чертеж детали, который ей не показали напрямую, и восстановила 3D-модель. В другом случае она нашла и устранила скрытую ошибку в популярном пакете управления, которую пропустили другие модели.
В финансовой и юридической сферах точность выросла на 9 процентных пунктов, а время выполнения задач сократилось на 60%. Модель эффективно работает с таблицами, проводит дью-дилидженс и анализирует данные, выявляя ошибки в коде и логике, которые ранее требовали ручного вмешательства.
Примеры использования в бизнесе:
- Разработка: Создание полноценных фидов рыночных данных и тестовых окружений за одну сессию.
- Юриспруденция: Подготовка поправок к документам (redlines) в два раза быстрее с сохранением точности.
- Торговля: Анализ торговых стратегий с использованием в 7 раз меньше токенов рассуждений и при задержке ниже, чем у Opus 4.8.
- Научные исследования: Проведение статистических тестов и перепроверка результатов независимыми методами.
Безопасность и ограничения
Anthropic подчеркивает, что Opus 5 — самая безопасная модель в линейке. В тестах на соответствие правилам (Claude Constitution) она показала лучший результат, минимизируя риски обмана и нежелательных действий. Однако модель не является лидером в задачах кибербезопасности и биологии: здесь она уступает специализированной модели Mythos 5.
Разработчики намеренно не обучали Opus 5 на задачах по взлому. Хотя модель хорошо находит уязвимости в коде, она значительно уступает Mythos 5 в создании эксплойтов (инструментов для атаки). Для защиты от злоупотреблений внедрены строгие фильтры:
- Разрешен поиск уязвимостей в исходном коде.
- Заблокированы сканирование бинарных файлов, пентесты и генерация эксплойтов.
- При срабатывании фильтров запрос автоматически перенаправляется на Opus 4.8.
Для исследователей и компаний, работающих в сфере кибербезопасности, доступен Cyber Verification Program (CVP), который предоставляет версию модели с ослабленными ограничениями. В биологических исследованиях модель также имеет ограничения на автономные долгосрочные эксперименты, где риски остаются высокими.
Важный нюанс: Безопасность модели строится на компромиссе: она способна находить ошибки, но лишена возможности использовать их для атаки, что делает её безопасным инструментом для аудита кода, но не для пентестинга без специального разрешения.
Условия запуска и доступность
Модель доступна с 24 июля 2026 года. Стоимость использования составляет $5 за миллион входных токенов и $25 за миллион выходных токенов, что совпадает с ценой Opus 4.8. Также доступен режим Fast, работающий в 2,5 раза быстрее, но вдвое дороже базовой версии.
Для разработчиков введены новые функции:
- Возможность менять доступные инструменты в ходе диалога без сброса кэша.
- Автоматическое переключение на другую модель при срабатывании фильтров безопасности через API.
Данные о запросах не хранятся для общего доступа, что соответствует политике конфиденциальности предыдущих версий.
На фоне этого: Одинаковая цена при двукратном росте производительности делает Opus 5 экономически выгодным выбором для миграции с предыдущих версий, позволяя бизнесу перераспределить бюджет на другие задачи.
Источник: anthropic.com