OpenAI выпустила GPT-5.5-Cyber — специализированную версию GPT-5.5, заточенную под поиск и закрытие уязвимостей в программном обеспечении. Модель сохраняет общий интеллект базовой GPT-5.5, но добавляет автономный цикл работы с дефектами безопасности: она определяет, достижим ли уязвимый код при реальном исполнении, проверяет находку в контролируемой среде, разрабатывает и тестирует патч и готовит доказательную базу для проверки человеком. Доступ к модели открыт не для всех — это ограниченный релиз для верифицированных защитников с дополнительным мониторингом.
Ключевые факты
- GPT-5.5-Cyber набрала 85,6% на CyberGym против 81,8% у базовой GPT-5.5 при сохранении её общего интеллекта.
- Самый крупный прирост — на ExploitGym: 39,5% против 25,95% у GPT-5.5, рост примерно в полтора раза; на SEC-bench Pro — 69,8% против 63,1%.
- Модель работает сквозным циклом: трассирует достижимость уязвимого кода, валидирует находку в изолированной среде, собирает и тестирует патч, готовит доказательства для ревью.
- Из-за двойного назначения доступ открыт только верифицированным защитникам с усиленным мониторингом — без общего API на условиях обычной GPT-5.5.
- Релиз входит в программу Daybreak вместе с инициативой Patch the Planet по безопасности открытого исходного кода.
Что умеет GPT-5.5-Cyber
Главное отличие от обычной языковой модели — не разовая генерация патча, а сквозной рабочий процесс. По описанию OpenAI, GPT-5.5-Cyber трассирует путь выполнения, чтобы установить, действительно ли уязвимый участок кода достижим, а не только формально присутствует в репозитории. Затем модель валидирует проблему в изолированном окружении, собирает исправление и проверяет, что оно закрывает дефект, не ломая остальную функциональность. На выходе — подготовленные материалы для ревью: где находится уязвимость, как она воспроизводится и что меняет предложенный патч.
Такой разворот в сторону проверяемости отличает релиз от чистого ассистента для разработчиков. CybersecurityNews описывает модель как инструмент, рассчитанный на работу внутри пайплайнов безопасности, где ложноположительные срабатывания дорого обходятся, а каждый вывод должен быть пригоден для аудита.
Бенчмарки
OpenAI приводит сравнение GPT-5.5-Cyber с базовой GPT-5.5 на трёх профильных наборах. Прирост заметен на всех трёх, но разной величины:
- CyberGym: 85,6% против 81,8% у GPT-5.5
- ExploitGym: 39,5% против 25,95% у GPT-5.5
- SEC-bench Pro: 69,8% против 63,1% у GPT-5.5
Самый крупный относительный скачок — на ExploitGym, где результат вырос примерно в полтора раза, с 25,95% до 39,5%. Этот набор оценивает способность довести уязвимость до рабочего эксплойта, и именно здесь специализация даёт больше всего — что одновременно объясняет осторожность OpenAI с доступом. На CyberGym, измеряющем обнаружение дефектов, разрыв скромнее: 3,8 процентных пункта.
Почему доступ ограничен
Модель, которая хорошо находит уязвимости и доводит их до эксплуатируемого состояния, по определению полезна и для атакующей стороны. Эту двойственность OpenAI выносит в центр анонса: релиз идёт как ограниченный доступ для верифицированных защитников с усиленным мониторингом и дополнительными контролями использования. Компания не открывает модель в общий API на тех же условиях, что обычные версии GPT-5.5.
Подход напрямую перекликается с тем, что несколькими неделями ранее сделала Anthropic с Mythos 5 — моделью без защитных классификаторов, доступной только проверенным подрядчикам в рамках программы Project Glasswing. Различие в инженерии: Anthropic строит одну архитектуру в двух конфигурациях — публичную Fable 5 с фильтрами и закрытую Mythos 5 без них, переключая диалог на более слабую модель при срабатывании классификатора. OpenAI идёт по другому пути — выпускает отдельную профильную модель и регулирует риск на уровне допуска и наблюдения, а не встроенных блокировок. В обоих случаях вывод индустрии один: фронтирная модель, сильная в кибербезопасности, не выкатывается в открытый доступ без оговорок.
Patch the Planet и программа Daybreak
Параллельно с моделью OpenAI запустила инициативу Patch the Planet — направление по безопасности открытого исходного кода, где упор сделан на массовое выявление и закрытие уязвимостей в публичных репозиториях. И модель, и Patch the Planet входят в расширенную программу Daybreak, под которой OpenAI группирует свои усилия по применению ИИ к защите программной инфраструктуры.
Логика связки понятна: цикл «найти — проверить — запатчить — подготовить к ревью» масштабируется на открытый код, где дефектов много, а рук на их обработку хронически не хватает. Здесь же проходит граница между обещанием и проверкой. Бенчмарки фиксируют возможности в контролируемых условиях, но реальная ценность инструмента в продакшене зависит от доли валидных патчей, ложных срабатываний и нагрузки на ревьюеров — цифр, которые проявятся только на дистанции эксплуатации.
Сдвиг, который стоит отслеживать, — институциональный. Связка специализированной модели, инициативы по открытому коду и зонтичной программы делает безопасность не побочным свойством релиза, а отдельной продуктовой линией. Сюда же ложится и смежная задача — контроль того, что автономным агентам разрешено делать в продакшене: модель, способная переписывать чужой код, требует не только допуска, но и слоя авторизации поверх своих действий. Что покажет дистанция — закрепится ли модель ограниченного доступа как отраслевая норма для кибер-моделей или давление рынка вернёт часть возможностей в открытый периметр.
Частые вопросы
Что такое GPT-5.5-Cyber?
Это специализированная версия GPT-5.5 от OpenAI для поиска и закрытия уязвимостей в коде. Она сохраняет общий интеллект GPT-5.5 и добавляет цикл: проверка достижимости уязвимого кода, валидация в изолированной среде, разработка и тестирование патча, подготовка доказательств для ревью человеком.
Какие результаты GPT-5.5-Cyber на бенчмарках?
CyberGym — 85,6% против 81,8% у базовой GPT-5.5, ExploitGym — 39,5% против 25,95%, SEC-bench Pro — 69,8% против 63,1%. Наибольший относительный прирост приходится на ExploitGym.
Почему доступ к GPT-5.5-Cyber ограничен?
Модель, сильная в поиске и эксплуатации уязвимостей, полезна и атакующей стороне. Из-за этого двойного назначения OpenAI открыла её только верифицированным защитникам с дополнительным мониторингом и контролями использования, а не в общий доступ.
Что такое Patch the Planet и Daybreak?
Patch the Planet — инициатива OpenAI по безопасности открытого исходного кода, ориентированная на массовое выявление и закрытие уязвимостей в публичных репозиториях. Daybreak — зонтичная программа OpenAI по применению ИИ к защите программной инфраструктуры, в которую входят и GPT-5.5-Cyber, и Patch the Planet.
Чем подход OpenAI отличается от Anthropic?
Anthropic выпускает одну архитектуру в двух конфигурациях — публичную Fable 5 с защитными классификаторами и закрытую Mythos 5 без них для проверенных подрядчиков. OpenAI выпускает отдельную профильную модель GPT-5.5-Cyber и регулирует риск на уровне допуска и мониторинга, а не встроенных блокировок.