OpenAI удвоил награды за поиск уязвимостей в биомоделях GPT-5.5 и GPT-5.6
OpenAI удвоила награду до 50 000 долларов за поиск уязвимостей, позволяющих ИИ генерировать опасные биологические инструкции. Такой шаг превращает защиту от биологических угроз в непрерывный процесс, заставляя компании пересматривать бюджеты на безопасность и полагаться на внешних исследователей.
Компания OpenAI расширяет программу поиска уязвимостей в своих биологических моделях искусственного интеллекта, превращая разовое мероприятие в постоянный формат. Награда за обнаружение универсального способа обхода защитных механизмов (так называемого «джилбрейка») увеличена с $25 000 до $50 000. Это изменение касается текущей модели GPT-5.5 и новой версии GPT-5.6. Цель инициативы — выявить способы, с помощью которых злоумышленники могут заставить модель генерировать опасные биологические инструкции, и устранить их до публичного релиза.
Важный нюанс: Рост награды вдвое сигнализирует о том, что разработчики считают риск создания биологического оружия с помощью ИИ критическим и готовы платить за его предотвращение больше, чем за многие другие типы уязвимостей.
Изменение правил и переход на новые модели
Программа претерпевает структурные изменения. Тестирование модели GPT-5.5 завершится 27 июля 2026 года. После этой даты в фокусе останется только новая версия GPT-5.6. Участники, уже подавшие заявку на предыдущую программу, не обязаны регистрироваться заново — они автоматически перейдут в новую фазу.
Новые правила участия включают:
- Подача краткой анкеты с указанием имени, места работы и опыта.
- Наличие действующего аккаунта ChatGPT.
- Подписание соглашения о неразглашении (NDA) после отбора.
- Возможность получения частичных наград за неполные результаты обхода защиты, если это решит команда безопасности.
Стоит учесть: Ограничение срока тестирования старой модели GPT-5.5 до конца июля 2026 года создает жесткий дедлайн для исследователей, желающих проверить именно эту версию перед её выводом из зоны активной безопасности.
Операционные последствия и тренды
- Рост стоимости кибербезопасности в биотехе: Увеличение выплат до $50 000 за одну уязвимость задает новый рыночный стандарт для программ Bug Bounty в чувствительных отраслях. Это может привести к росту затрат на безопасность для других компаний, разрабатывающих ИИ для биологии.
- Сдвиг фокуса на превентивную защиту: Переход от разовых кампаний к постоянному мониторингу («ongoing private program») означает, что безопасность биологических моделей становится непрерывным процессом, а не этапом разработки. Компании должны быть готовы к постоянному аудиту своих алгоритмов.
- Зависимость от сообщества исследователей: Эффективность защиты теперь напрямую зависит от активности внешних специалистов. Без постоянного потока заявок от независимых исследователей компания рискует пропустить сложные векторы атак, которые не видны внутренней команде.
На фоне этого: Стратегия OpenAI показывает, что в области биобезопасности ИИ традиционные методы тестирования недостаточны, и компании вынуждены делегировать часть ответственности за безопасность внешнему сообществу, платя за это существенные суммы.
Источник: openai.com