OpenAI выпустила GPT-5.5-Cyber — специализированную версию GPT-5.5, заточенную под поиск и закрытие уязвимостей в программном обеспечении. Модель сохраняет общий интеллект базовой GPT-5.5, но добавляет автономный цикл работы с дефектами безопасности: она определяет, достижим ли уязвимый код при реальном исполнении, проверяет находку в контролируемой среде, разрабатывает и тестирует патч и готовит доказательную базу для проверки человеком. Доступ к модели открыт не для всех — это ограниченный релиз для верифицированных защитников с дополнительным мониторингом.

Ключевые факты

  • GPT-5.5-Cyber набрала 85,6% на CyberGym против 81,8% у базовой GPT-5.5 при сохранении её общего интеллекта.
  • Самый крупный прирост — на ExploitGym: 39,5% против 25,95% у GPT-5.5, рост примерно в полтора раза; на SEC-bench Pro — 69,8% против 63,1%.
  • Модель работает сквозным циклом: трассирует достижимость уязвимого кода, валидирует находку в изолированной среде, собирает и тестирует патч, готовит доказательства для ревью.
  • Из-за двойного назначения доступ открыт только верифицированным защитникам с усиленным мониторингом — без общего API на условиях обычной GPT-5.5.
  • Релиз входит в программу Daybreak вместе с инициативой Patch the Planet по безопасности открытого исходного кода.

Что умеет GPT-5.5-Cyber

Главное отличие от обычной языковой модели — не разовая генерация патча, а сквозной рабочий процесс. По описанию OpenAI, GPT-5.5-Cyber трассирует путь выполнения, чтобы установить, действительно ли уязвимый участок кода достижим, а не только формально присутствует в репозитории. Затем модель валидирует проблему в изолированном окружении, собирает исправление и проверяет, что оно закрывает дефект, не ломая остальную функциональность. На выходе — подготовленные материалы для ревью: где находится уязвимость, как она воспроизводится и что меняет предложенный патч.

Такой разворот в сторону проверяемости отличает релиз от чистого ассистента для разработчиков. CybersecurityNews описывает модель как инструмент, рассчитанный на работу внутри пайплайнов безопасности, где ложноположительные срабатывания дорого обходятся, а каждый вывод должен быть пригоден для аудита.

Бенчмарки

OpenAI приводит сравнение GPT-5.5-Cyber с базовой GPT-5.5 на трёх профильных наборах. Прирост заметен на всех трёх, но разной величины:

  • CyberGym: 85,6% против 81,8% у GPT-5.5
  • ExploitGym: 39,5% против 25,95% у GPT-5.5
  • SEC-bench Pro: 69,8% против 63,1% у GPT-5.5

Самый крупный относительный скачок — на ExploitGym, где результат вырос примерно в полтора раза, с 25,95% до 39,5%. Этот набор оценивает способность довести уязвимость до рабочего эксплойта, и именно здесь специализация даёт больше всего — что одновременно объясняет осторожность OpenAI с доступом. На CyberGym, измеряющем обнаружение дефектов, разрыв скромнее: 3,8 процентных пункта.

Почему доступ ограничен

Модель, которая хорошо находит уязвимости и доводит их до эксплуатируемого состояния, по определению полезна и для атакующей стороны. Эту двойственность OpenAI выносит в центр анонса: релиз идёт как ограниченный доступ для верифицированных защитников с усиленным мониторингом и дополнительными контролями использования. Компания не открывает модель в общий API на тех же условиях, что обычные версии GPT-5.5.

Подход напрямую перекликается с тем, что несколькими неделями ранее сделала Anthropic с Mythos 5 — моделью без защитных классификаторов, доступной только проверенным подрядчикам в рамках программы Project Glasswing. Различие в инженерии: Anthropic строит одну архитектуру в двух конфигурациях — публичную Fable 5 с фильтрами и закрытую Mythos 5 без них, переключая диалог на более слабую модель при срабатывании классификатора. OpenAI идёт по другому пути — выпускает отдельную профильную модель и регулирует риск на уровне допуска и наблюдения, а не встроенных блокировок. В обоих случаях вывод индустрии один: фронтирная модель, сильная в кибербезопасности, не выкатывается в открытый доступ без оговорок.

Patch the Planet и программа Daybreak

Параллельно с моделью OpenAI запустила инициативу Patch the Planet — направление по безопасности открытого исходного кода, где упор сделан на массовое выявление и закрытие уязвимостей в публичных репозиториях. И модель, и Patch the Planet входят в расширенную программу Daybreak, под которой OpenAI группирует свои усилия по применению ИИ к защите программной инфраструктуры.

Логика связки понятна: цикл «найти — проверить — запатчить — подготовить к ревью» масштабируется на открытый код, где дефектов много, а рук на их обработку хронически не хватает. Здесь же проходит граница между обещанием и проверкой. Бенчмарки фиксируют возможности в контролируемых условиях, но реальная ценность инструмента в продакшене зависит от доли валидных патчей, ложных срабатываний и нагрузки на ревьюеров — цифр, которые проявятся только на дистанции эксплуатации.

Сдвиг, который стоит отслеживать, — институциональный. Связка специализированной модели, инициативы по открытому коду и зонтичной программы делает безопасность не побочным свойством релиза, а отдельной продуктовой линией. Сюда же ложится и смежная задача — контроль того, что автономным агентам разрешено делать в продакшене: модель, способная переписывать чужой код, требует не только допуска, но и слоя авторизации поверх своих действий. Что покажет дистанция — закрепится ли модель ограниченного доступа как отраслевая норма для кибер-моделей или давление рынка вернёт часть возможностей в открытый периметр.

Частые вопросы

Что такое GPT-5.5-Cyber?

Это специализированная версия GPT-5.5 от OpenAI для поиска и закрытия уязвимостей в коде. Она сохраняет общий интеллект GPT-5.5 и добавляет цикл: проверка достижимости уязвимого кода, валидация в изолированной среде, разработка и тестирование патча, подготовка доказательств для ревью человеком.

Какие результаты GPT-5.5-Cyber на бенчмарках?

CyberGym — 85,6% против 81,8% у базовой GPT-5.5, ExploitGym — 39,5% против 25,95%, SEC-bench Pro — 69,8% против 63,1%. Наибольший относительный прирост приходится на ExploitGym.

Почему доступ к GPT-5.5-Cyber ограничен?

Модель, сильная в поиске и эксплуатации уязвимостей, полезна и атакующей стороне. Из-за этого двойного назначения OpenAI открыла её только верифицированным защитникам с дополнительным мониторингом и контролями использования, а не в общий доступ.

Что такое Patch the Planet и Daybreak?

Patch the Planet — инициатива OpenAI по безопасности открытого исходного кода, ориентированная на массовое выявление и закрытие уязвимостей в публичных репозиториях. Daybreak — зонтичная программа OpenAI по применению ИИ к защите программной инфраструктуры, в которую входят и GPT-5.5-Cyber, и Patch the Planet.

Чем подход OpenAI отличается от Anthropic?

Anthropic выпускает одну архитектуру в двух конфигурациях — публичную Fable 5 с защитными классификаторами и закрытую Mythos 5 без них для проверенных подрядчиков. OpenAI выпускает отдельную профильную модель GPT-5.5-Cyber и регулирует риск на уровне допуска и мониторинга, а не встроенных блокировок.