OpenAI открыла защитникам доступ к GPT-5.6-Cyber: модель ищет уязвимости нулевого дня и собирает цепочки эксплойтов.
OpenAI открыла защитникам доступ к моделям, которые ищут уязвимости и пишут эксплойты. Вместе с этим компания показала GPT-5.6-Cyber на базе GPT-5.6 Sol. Её учили искать уязвимости нулевого дня, собирать цепочки эксплойтов и реже отказываться от таких задач. В OpenAI объясняют это тем, что окно до массового внедрения наступательного ИИ у атакующих закрывается.
Двухуровневая программа Daybreak
Программа Daybreak теперь двухуровневая. На уровне Blue дают обычные фронтир-модели, включая Sol, но со снятыми системными фильтрами. В продакшене эти фильтры резали и настоящую защитную работу: разбор вредоносов, ревью кода, реагирование на инциденты, проверку патчей. На уровне Red открывают специализированные кибермодели для авторизованного поиска уязвимостей, проверки эксплойтов и тестирования. Там же лежит GPT-5.6-Cyber.
На внутреннем наборе запросов про цепочки эксплойтов, обход аутентификации и повышение привилегий GPT-5.6-Cyber отвечает в 95,0% случаев, обычный Sol в 1,5%, Sol с доступом Blue в 2,0%, прошлая GPT-5.5-Cyber в 57,3%.
Доступ и требования
Доступ дают только по заявке. Подать её могут отдельные исследователи и организации. Дальше OpenAI проверяет личность заявителя, требует защиты аккаунта и юридических заверений о характере работ, ограничивает разрешённые сценарии и мониторит запросы. Большинству советуют начинать с Blue, а Red просят запрашивать тех, у кого в задачах действительно есть исследование уязвимостей, разработка эксплойтов и работа red team. С 1 сентября все личные аккаунты в программе обязаны перейти на аппаратные ключи, а тех, кто работает через Codex, переводят в режим авто-ревью, где действия с повышенными правами проверяются до выполнения. Заявку принимают на сайте.
Проверка на живом коде
До релиза модель проверяли на живом коде. В V8, движке JavaScript в Chrome, она нашла две ранее неизвестные уязвимости, которые в связке позволяли повредить память кучи и выйти из песочницы. Google починил, им присвоили CVE-2026-15903. Ещё она нашла не менее пяти уязвимостей в популярной мобильной ОС, три критические в популярной базе данных и более 400 уязвимостей с повышением привилегий в ядре популярной ОС. Названия продуктов не раскрывают.
Универсальнее от специализации модель не стала. На ExploitBench с лимитом в 300 ходов обычный Sol решает больше задач и тратит меньше токенов, а отчёты об уязвимостях у Cyber выходят короче и слабее. По внутренней шкале рисков обе модели попадают в высокий уровень киберспособностей и не дотягивают до критического. К взлому Hugging Face GPT-5.6-Cyber отношения не имеет.

