Grok 4.7 удвоил скорость работы и обогнал GPT-5.6 Sol по цене
SpaceXAI представила Grok 4.7, которая работает вдвое быстрее аналогов при цене $2 за миллион входных токенов. Это делает модель привлекательной для бизнеса, где критичны скорость обработки и стоимость вычислений.
SpaceXAI представила Grok 4.7 — модель, сфокусированную на программировании и интеллектуальных задачах. Компания заявляет о двукратном увеличении скорости работы по сравнению с аналогами при сохранении цены на уровне $2 за миллион входных токенов. Это позиционирует продукт как конкурентоспособный вариант для бизнеса, где важны стоимость вычислений и время отклика.
Технические характеристики и производительность
Grok 4.7 построен на более крупной базовой модели, чем предыдущая версия Grok 4.6. Обучение проводилось с использованием усиленного обучения (reinforcement learning) на сложном наборе задач, где акцент сделан на решения, требующие часов работы. Модель научилась лучше проверять собственные результаты и работать с длинным контекстом.
Ключевые изменения в архитектуре:
- Автопроверка: Алгоритм стал внимательнее относиться к верификации своих действий, что снижает количество ошибок в длительных задачах.
- Интеграция с инструментами: Модель нативно понимает «Grok Bot harness», что улучшает качество ответов на диалоговые запросы и общие знания.
- Скорость: Выпускная версия работает вдвое быстрее, чем стандартная, но стоит в два раза дороже ($4 за входные токены).
Сравнение с конкурентами
На бенчмарке CursorBench 4.0, который тестирует длительные программные задачи, Grok 4.7 показывает результаты на уровне передовых моделей. Ниже приведено сравнение ключевых метрик производительности и стоимости.
| Метрика | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 Max |
|---|---|---|---|---|
| Цена входных токенов ($/млн) | $2 | $2 | $4 | $10 |
| Цена выходных токенов ($/млн) | $6 | $6 | $20 | $50 |
| CursorBench 4.0 (программирование) | 46.3% | 40.4% | 41.7% | 51.8% |
| DeepSWE v1.1 (инженерия ПО) | 71.0%* | 65.2% | 72.7% | 70.0% |
| Terminal-Bench 4.0 (работа в терминале) | 38.0% | 20.3% | 37.3% | 57.9% |
| Harvey Legal Agent (юридические задачи) | 19.6% | 15.8% | 2.5% | 6.7% |
* Результат с высоким уровнем сложности (high effort).
Разрыв в стоимости между Grok 4.7 и GPT-5.6 Sol составляет двукратную разницу при сопоставимой производительности на большинстве тестов. Это может стать фактором для пересмотра бюджетов на ИИ-инфраструктуру компаниями, работающими с большими объемами текстовых данных.
Безопасность и специализация
Компания внедрила новый стек защитных механизмов. По данным SpaceXAI, модель демонстрирует наилучшие результаты в сопротивлении джейлбрейкам (обходу ограничений) среди всех протестированных версий.
- Кибербезопасность: На тесте HackerBench v0.3 модель пропускает лишь 3.3% опасных запросов двойного назначения, при этом не блокируя легитимные задачи по безопасности.
- Биобезопасность: Grok 4.7 занимает первое место на бенчмарке LatchBio с результатом 62.4%.
- Доступ для партнеров: Отдельным кибербезопасным партнерам предоставлен доступ к red-team функциям модели для исследований в области защиты.
Доступность и цены
Grok 4.7 уже доступен через API, платформы Cursor и Grok Build, а также через сторонние роутеры моделей и облачные сервисы.
Базовая тарификация:
- Входные токены: $2 за миллион.
- Выходные токены: $6 за миллион.
Существует быстрый вариант (fast variant), который генерирует ответы вдвое быстрее, но стоит в два раза дороже стандартной версии. Для разработчиков доступен бесплатный тестовый период через Grok Build.
Подтверждение: x.ai