Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

OpenAI открыла защитникам доступ к GPT-5.6-Cyber: модель ищет уязвимости нулевого дня и собирает цепочки эксплойтов.

OpenAI открыла защитникам доступ к моделям, которые ищут уязвимости и пишут эксплойты. Вместе с этим компания показала GPT-5.6-Cyber на базе GPT-5.6 Sol. Её учили искать уязвимости нулевого дня, собирать цепочки эксплойтов и реже отказываться от таких задач. В OpenAI объясняют это тем, что окно до массового внедрения наступательного ИИ у атакующих закрывается.

Двухуровневая программа Daybreak

Программа Daybreak теперь двухуровневая. На уровне Blue дают обычные фронтир-модели, включая Sol, но со снятыми системными фильтрами. В продакшене эти фильтры резали и настоящую защитную работу: разбор вредоносов, ревью кода, реагирование на инциденты, проверку патчей. На уровне Red открывают специализированные кибермодели для авторизованного поиска уязвимостей, проверки эксплойтов и тестирования. Там же лежит GPT-5.6-Cyber.

На внутреннем наборе запросов про цепочки эксплойтов, обход аутентификации и повышение привилегий GPT-5.6-Cyber отвечает в 95,0% случаев, обычный Sol в 1,5%, Sol с доступом Blue в 2,0%, прошлая GPT-5.5-Cyber в 57,3%.

Доступ и требования

Доступ дают только по заявке. Подать её могут отдельные исследователи и организации. Дальше OpenAI проверяет личность заявителя, требует защиты аккаунта и юридических заверений о характере работ, ограничивает разрешённые сценарии и мониторит запросы. Большинству советуют начинать с Blue, а Red просят запрашивать тех, у кого в задачах действительно есть исследование уязвимостей, разработка эксплойтов и работа red team. С 1 сентября все личные аккаунты в программе обязаны перейти на аппаратные ключи, а тех, кто работает через Codex, переводят в режим авто-ревью, где действия с повышенными правами проверяются до выполнения. Заявку принимают на сайте.

Проверка на живом коде

До релиза модель проверяли на живом коде. В V8, движке JavaScript в Chrome, она нашла две ранее неизвестные уязвимости, которые в связке позволяли повредить память кучи и выйти из песочницы. Google починил, им присвоили CVE-2026-15903. Ещё она нашла не менее пяти уязвимостей в популярной мобильной ОС, три критические в популярной базе данных и более 400 уязвимостей с повышением привилегий в ядре популярной ОС. Названия продуктов не раскрывают.

Универсальнее от специализации модель не стала. На ExploitBench с лимитом в 300 ходов обычный Sol решает больше задач и тратит меньше токенов, а отчёты об уязвимостях у Cyber выходят короче и слабее. По внутренней шкале рисков обе модели попадают в высокий уровень киберспособностей и не дотягивают до критического. К взлому Hugging Face GPT-5.6-Cyber отношения не имеет.

Этот пост Вконтакте:

Ещё новости:

США возвращаются в открытый ИИ: Inkling, Laguna S 2.1 и Muse Glimmer.
Anthropic включает Auto Mode по умолчанию в Claude Code: ИИ-проверяющий будет принимать решения без участия человека.
xAI выпустила Grok 4.6: модель сравнялась с GPT-5.6 Sol и стала экономичнее Opus 5.
DeepSeek V4 Pro 0813 тихо вышел в API: миллион токенов контекста и цены от 0,435 доллара.
ByteDance добавила в OpenRouter Seed 2.0 Code, Seed 2.1 Turbo и видеогенератор Seedance 2.0 Mini.
OpenAI показала Ultrafast для GPT-5.6 Sol: до 750 токенов в секунду.
Google выпустила Gemini 3.7 Flash: модель для агентов и кодинга уже в OpenRouter.
Qwen3-ASR теперь в OpenRouter: распознавание речи на 0,6 и 1,7 млрд параметров.
Опенсорсная библиотека Kinetics: 140+ анимаций для интерфейсов с кодом для CSS и React.
ИИ-агенты Anthropic воевали и пытались отключить друг друга, лишь бы выполнить задание.