DeepSWE v1.1
DeepSWE v1.1 в новостной повестке, календарь упоминаний и aналитика в реальном времени.
Календарь упоминаний:
2026
22 сентября
Grok 4.7 демонстрирует рост показателей на бенчмарке DeepSWE v1.1
SpaceXAI представила модель Grok 4.7, которая показала результат 71.0% в тесте инженерии программного обеспечения DeepSWE v1.1. Этот показатель превышает результаты предыдущей версии Grok 4.6 (65.2%) и Fable 5.1 Max (70.0%), но уступает GPT-5.6 Sol (72.7%).
Событие: На бенчмарке DeepSWE v1.1 модель Grok 4.7 достигла отметки 71.0% при высоком уровне сложности, что свидетельствует об улучшении навыков решения инженерных задач по сравнению с версией 4.6.
Фактор: Усиленное обучение на сложном наборе задач, требующих часов работы, способствовало повышению точности модели в метрике DeepSWE v1.1 за счет улучшения процессов самопроверки.
В нашей базе собрано 1 событие по теме «DeepSWE v1.1». Мы показываем все из них.