OpenAI представила GPT-5.6 Sol, Terra и Luna — автоматизация задач стала в 4 раза дешевле
Стоимость работы флагманской модели OpenAI упала в четыре раза, а скорость решения сложных задач выросла благодаря режиму параллельных агентов. Это меняет экономику автоматизации: бизнес теперь может внедрять ИИ в процессы, которые ранее были слишком дороги для окупаемости.
OpenAI выпустила в общий доступ новое семейство моделей GPT-5.6, состоящее из трех версий: флагманской Sol, сбалансированной Terra и бюджетной Luna. Главный акцент сделан не только на росте интеллектуальных способностей, но и на радикальном снижении стоимости выполнения задач. Флагманская модель Sol демонстрирует рекордные результаты в программировании, кибербезопасности и науке, при этом потребляя меньше вычислительных ресурсов, чем предыдущие поколения и конкуренты.
Компания представила новый режим ultra, позволяющий координировать работу нескольких агентов параллельно для ускорения решения сложных задач. В бенчмарках модели показывают значительное преимущество в скорости и точности, особенно в сценариях, требующих длительного анализа и работы с инструментами. Например, в тесте на агентные рабочие процессы Sol опережает ближайшего конкурента Claude Fable 5 на 13,1 пункта, выполняя задачи при стоимости в четыре раза ниже.
Важный нюанс: Переход на новые модели может потребовать пересмотра бюджетов на ИИ-инфраструктуру, так как снижение стоимости токена при сохранении качества работы меняет экономику внедрения автоматизации.
Архитектура производительности и новые режимы работы
Семейство GPT-5.6 спроектировано так, чтобы извлекать максимум пользы из каждого токена. Это достигается за счет оптимизации внутренних процессов и введения новых режимов работы, которые позволяют гибко управлять балансом между скоростью, качеством и стоимостью.
- GPT-5.6 Sol: Флагманская модель для самых сложных задач. Она устанавливает новые стандарты в программировании, науке и кибербезопасности. Модель способна анализировать, дорабатывать и выдавать готовые к использованию результаты с минимальным участием человека.
- GPT-5.6 Terra: Сбалансированная модель для повседневной работы. Она превосходит по эффективности предыдущие флагманы при значительно меньшей стоимости.
- GPT-5.6 Luna: Самая экономичная и быстрая модель. Она предлагает производительность, сопоставимую с более дорогими предшественниками, но за четверть цены.
Для задач, требующих максимальной точности и времени на размышления, доступен режим max, который дает модели больше времени на анализ альтернатив. Для сверхсложных проектов предназначен режим ultra. Он по умолчанию запускает 4 параллельных агента, что позволяет сократить время выполнения задачи и повысить качество результата за счет распределения работы.
Стоит учесть: Режим ultra с параллельными агентами меняет подход к решению задач: вместо последовательного выполнения шагов система теперь может обрабатывать несколько аспектов проблемы одновременно, что критически важно для крупных инженерных проектов.
Практические результаты в программировании и дизайне
В области разработки программного обеспечения GPT-5.6 Sol показывает результаты, которые ранее были недостижимы. В независимом индексе Artificial Analysis Coding Agent Index модель набрала 80 баллов, превзойдя конкурентов. При этом она использует менее половины выходных токенов и тратит меньше времени на выполнение кода.
Ключевым нововведением стал программный вызов инструментов (Programmatic Tool Calling). Теперь модель может писать и запускать легковесные программы для координации инструментов, обработки промежуточных данных и принятия решений. Это снижает количество обращений к модели и сокращает объем передаваемых данных.
В сфере дизайна и создания интерфейсов модель демонстрирует способность работать с визуальными задачами на новом уровне:
- Создание эстетичных и функциональных интерфейсов по высокоуровневым инструкциям.
- Самостоятельная проверка и доработка отрендеренного результата, выявление визуальных ошибок.
- Генерация полностью редактируемых презентаций и документов с соблюдением дизайн-систем.
В тестах на создание презентаций Sol использовала на 39% меньше токенов по сравнению с конкурентами, при этом создавая более проработанные слайды, требующие меньше правок.
Важный нюанс: Возможность модели самостоятельно проверять и исправлять визуальные результаты до финальной выдачи сокращает цикл разработки интерфейсов и снижает нагрузку на дизайнеров и верстальщиков.
Кибербезопасность, наука и меры защиты
GPT-5.6 позиционируется как наиболее мощная модель для задач кибербезопасности. В бенчмарках, оценивающих способность находить и эксплуатировать уязвимости, модель показывает значительный рост эффективности:
- В тесте ExploitBench2 результат составил 73,5% против 47,9% у предыдущей версии.
- В ExploitGym3 показатель успешного создания эксплойтов вырос почти вдвое — с 15,1% до 24,9% (за два часа) и до 33,7% (за шесть часов).
Важно отметить, что модель лучше справляется с поиском и закрытием уязвимостей, чем с проведением автономных атак на защищенные цели. Это позволяет специалистам по безопасности укреплять системы до того, как их слабые места будут использованы злоумышленниками.
Для доступа к расширенным возможностям в сфере кибербезопасности вводится требование о верификации пользователей. До 1 сентября индивидуальные пользователи должны включить функцию расширенной безопасности с использованием аппаратных ключей доступа. Организации могут подать заявку на доверенный доступ для своих команд.
В научной сфере, особенно в биологии и химии, модель демонстрирует улучшение по Парето: более высокие результаты при меньшем количестве токенов и времени. Это ускоряет внутренние исследования и позволяет быстрее проводить эксперименты.
Условия доступа и тарифы
Модели GPT-5.6 доступны с сегодняшнего дня в сервисах ChatGPT, Codex и через OpenAI API. Полное развертывание по всему миру ожидается в течение 24 часов.
Тарифная сетка построена на оплате за 1 млн токенов:
| Модель | Ввод (за 1 млн токенов) | Вывод (за 1 млн токенов) |
|---|---|---|
| Sol | 5 $ | 30 $ |
| Terra | 2,50 $ | 15 $ |
| Luna | 1 $ | 6 $ |
Пользователи планов Pro и Enterprise получают доступ к версии Sol Pro для задач высочайшего качества. В ChatGPT Work и Codex доступны режимы max и ultra для соответствующих тарифных планов. Также внедрено улучшенное кэширование промптов с тарификацией записей в кэш по ставке 1,25× от тарифа модели и скидкой 90% на чтение из кэша.
На фоне этого: Внедрение кэширования с предсказуемой стоимостью и возможность выбора уровня вычислительных затрат позволяют бизнесу более точно прогнозировать расходы на ИИ-операции, избегая неожиданных переплат за избыточную мощность.
Операционные последствия и тренды
- Снижение стоимости автоматизации: Радикальное падение цены за токен при росте качества позволяет внедрять ИИ-агентов в процессы, которые ранее были экономически нецелесообразны. Это может привести к масштабной автоматизации рутинных задач в программировании, аналитике и дизайне.
- Требования к инфраструктуре безопасности: Введение обязательных аппаратных ключей для доступа к мощным функциям кибербезопасности потребует от организаций и продвинутых пользователей дополнительных инвестиций в средства аутентификации и пересмотра политик доступа.
- Смена парадигмы разработки: Возможность модели самостоятельно писать и запускать программы для координации инструментов (Programmatic Tool Calling) меняет роль разработчика. Вместо написания скриптов для каждого шага специалист теперь формулирует задачу, а модель управляет процессом, что требует новых навыков управления и контроля за автономными агентами.
- Риски двойного назначения: Усиление возможностей модели в области поиска уязвимостей создает риск их использования злоумышленниками, если защитные механизмы будут обойдены. OpenAI подчеркивает, что модель лучше находит уязвимости, чем эксплуатирует их, но необходимость постоянного обновления защитных фильтров остается критической задачей.
Источник: openai.com