OpenAI выпустила GPT-5.6-Cyber, модель для проверенных специалистов по кибербезопасности

OpenAI выпустила GPT-5.6-Cyber, модель для проверенных специалистов по кибербезопасности

OpenAI расширила свою программу ограниченного доступа Daybreak, через которую проверенные специалисты по кибербезопасности получают доступ к моделям с ослабленными защитными фильтрами. Программа теперь делится на две ступени: Daybreak Blue даёт доступ к универсальным топ-моделям компании, включая GPT-5.6 Sol, со снятыми системными ограничениями для авторизованной защитной работы, поиска уязвимостей, разбора вредоносного ПО, реагирования на инциденты, проверки патчей и безопасной проверки кода; Daybreak Red открывает доступ к специализированным кибермоделям для авторизованных исследований уязвимостей, проверки эксплойтов и тестирования на проникновение. Одновременно компания представила GPT-5.6-Cyber, новую модель на базе GPT-5.6 Sol, обученную специально под наступательные кибербезопасные задачи и доступную только через Daybreak Red.

Логика OpenAI: злоумышленники всё активнее используют ИИ для атак, вплоть до полностью автономных, и «окно» для подготовки защитников сужается, поэтому компания хочет раньше атакующих дать проверенным защитникам доступ к передовому интеллекту. По словам компании, GPT-5.6 Sol уже показывает передовые результаты на кибербезопасных задачах, но системные фильтры, которые блокируют потенциально опасные запросы, попутно блокируют и легитимную защитную работу; доступ через Daybreak Blue снимает эти фильтры. Но даже без них модель отказывается выполнять ряд задач двойного назначения (например, тестирование продакшн-систем на проникновение), именно для таких сценариев обучили GPT-5.6-Cyber.

Снижение числа отказов OpenAI измеряет отдельным внутренним тестом, Advanced Cybersecurity Completion Rate, который проверяет, отвечает ли модель на запросы про разработку цепочек эксплойтов, обход аутентификации, повышение привилегий и другие продвинутые кибер-сценарии. GPT-5.6-Cyber через Daybreak Red выполняет 95,0% таких запросов; обычная GPT-5.6 Sol, только 1,5%, а та же GPT-5.6 Sol через Daybreak Blue, 2,0%. Для сравнения, предыдущая специализированная модель, GPT-5.5-Cyber, выполняла лишь 57,3% запросов, OpenAI отмечает, что новая модель отвечает на жалобы исследователей безопасности, которые сталкивались с постоянными отказами предыдущей версии.

На бенчмарке ExploitGym, который проверяет, может ли агент превратить известную уязвимость в рабочий эксплойт с выполнением произвольного кода в контролируемой среде, GPT-5.6-Cyber превосходит и GPT-5.6 Sol, и GPT-5.5-Cyber, точные цифры OpenAI не приводит. На отдельном внутреннем тесте по поиску и калибровке серьёзности новых уязвимостей нулевого дня GPT-5.6-Cyber (через Daybreak Red) также обошла GPT-5.6 Sol (через Daybreak Blue), сказалось специализированное обучение. А вот на тесте по поиску уязвимостей и написанию отчётов о них (Vulnerability Discovery and Report Writing) GPT-5.6-Cyber уступает GPT-5.6 Sol: обе модели превосходят GPT-5.5-Cyber, но, по объяснению OpenAI, GPT-5.6-Cyber иногда пишет более короткие и менее подробные отчёты об уязвимостях. Наконец, тест ExploitBench проверяет способность агента довести уязвимость движка V8 до полноценного эксплойта при включённых защитах вроде песочницы V8, это более сложная задача, чем в ExploitGym: защит больше, а сведений об уязвимости агенту дают меньше. В стандартном режиме с лимитом 300 ходов GPT-5.6 Sol через Daybreak Blue решает задачи эффективнее по числу токенов и показывает лучший результат; если увеличить лимит до 600 ходов, разрыв между моделями сокращается, кто побеждает при таком лимите, OpenAI не уточняет.

По словам OpenAI, ранний доступ к GPT-5.6-Cyber получила группа доверенных клиентов-партнёров; один из них (имя не раскрывается) заявил, что модель «заметно улучшает» их специализированные процессы поиска уязвимостей, точнее рассуждает о реальных ограничениях эксплойтов, лучше отслеживает сложное состояние системы и закрывает менее чем за день задачи, которые более ранние модели не могли решить за недели прерывистой работы; по его словам, сокращение лишних отказов в управляемой среде Trusted Access помогает исследователям сохранять темп и тратить больше времени на проверку находок. Сама OpenAI использовала GPT-5.6-Cyber для исследования реального ПО: в движке V8 (JavaScript-движок Chrome) модель нашла две ранее неизвестные уязвимости, которые вместе позволяли повредить память и выйти за пределы песочницы V8; находки проверили исследователи OpenAI и передали Google по процедуре скоординированного раскрытия. Google уже исправила первую из них, ошибку в оптимизирующем компиляторе V8, которая пропускала проверку безопасности при преобразовании значений в целые числа и позволяла неопределённому значению превращаться в неожиданно большое число; если такое число использовалось как индекс массива, компилятор мог решить, что оно укладывается в границы массива, и пропустить проверку границ, тогда атакующий получал возможность читать и перезаписывать чужую память и потенциально выполнять произвольный код внутри песочницы Chrome. Этой уязвимости присвоен номер CVE-2026-15903; получила ли отдельный номер CVE вторая уязвимость, нужная для выхода за пределы песочницы, источник не уточняет. Помимо V8, GPT-5.6-Cyber нашла минимум 5 уязвимостей в неназванной популярной мобильной ОС (включая цепочку от непривилегированного приложения до локального повышения привилегий), 3 критические уязвимости в неназванной популярной базе данных (включая удалённый путь к выполнению кода) и свыше 400 уязвимостей, ведущих к повышению привилегий, в ядре неназванной популярной операционной системы; сейчас OpenAI вместе с партнёрами Daybreak и open-source-сообществом занимается их устранением.

По собственной шкале риска OpenAI, методике Preparedness Framework, модель GPT-5.6 Sol по кибербезопасным возможностям отнесена к «высокому» уровню риска, но ниже «критического» порога; GPT-5.6-Cyber по итогам отдельной проверки перед запуском оценена так же: «высокий» уровень, не «критический». Модель улучшила отдельные специализированные кибер-навыки, на которые её целенаправленно обучали, но недостаточно, чтобы пересечь критический порог. OpenAI отдельно уточнила, что GPT-5.6-Cyber не имеет отношения к более раннему инциденту со взломом Hugging Face, как и никакая другая модель, которую компания планирует выпускать в обозримом будущем. Отдельную системную карту с дополнительными оценками GPT-5.6-Cyber OpenAI обещает опубликовать позже, точная дата не названа.

Доступ к Daybreak Blue и Daybreak Red открыт только одобренным физическим лицам и организациям, ведущим авторизованную работу; OpenAI проверяет заявителей через верификацию личности, требования к безопасности аккаунта, мониторинг, ограничения по разрешённому использованию и юридические заверения. С 1 сентября 2026 года все личные аккаунты Daybreak обязаны использовать аппаратные ключи безопасности. Компания также настоятельно рекомендует, но пока не требует, чтобы пользователи Codex внутри Daybreak перешли с режима полного доступа на режим автоматической проверки действий, при котором операции с повышенными правами проверяются перед выполнением, а запросы с высоким риском разрушительных последствий могут блокироваться; в ближайших планах, расширенный мониторинг и усиленное обучение согласованности (alignment) моделей для будущих выпусков Daybreak. Среди рекомендованных практик, работать в изолированных песочницах без доступа к боевым системам и открытому интернету и регулярно проверять границы этой изоляции; включать автоматическую проверку и человеческий контроль для рискованных сценариев; заранее чётко описывать разрешённые системы и действия через профили доступа с ограниченными правами. Организации дополнительно могут настраивать политику проверки под свои процессы. Стартовой точкой для большинства защитников OpenAI называет именно Daybreak Blue. Цены, сроки открытия более широкого доступа или лист ожидания для Daybreak компания не раскрывает.

Ключевые факты

  • OpenAI разделила доступ к программе Daybreak на две ступени: Daybreak Blue, топ-модели вроде GPT-5.6 Sol без обычных защитных фильтров для авторизованной защитной работы, и Daybreak Red, специализированные кибермодели для авторизованного поиска уязвимостей и проверки эксплойтов.
  • Новая модель GPT-5.6-Cyber (доступна через Daybreak Red) выполняет 95,0% сложных наступательных кибер-запросов против 1,5% у обычной GPT-5.6 Sol, 2,0% у GPT-5.6 Sol через Daybreak Blue и 57,3% у предыдущей модели GPT-5.5-Cyber.
  • С помощью GPT-5.6-Cyber OpenAI нашла в движке Chrome V8 две ранее неизвестные уязвимости для выхода за пределы песочницы; одну Google уже исправила и присвоила ей номер CVE-2026-15903.
  • Той же моделью найдены минимум 5 уязвимостей в неназванной популярной мобильной ОС, 3 критические, в неназванной популярной базе данных и свыше 400, в ядре неназванной популярной ОС; устранение идёт совместно с партнёрами Daybreak и open-source-сообществом.
  • По Preparedness Framework OpenAI обе модели, GPT-5.6 Sol и GPT-5.6-Cyber, оценены как модели «высокого» кибербезопасного риска, ниже «критического» порога; с 1 сентября 2026 года все личные аккаунты Daybreak обязаны использовать аппаратные ключи безопасности.

Почему это важно

OpenAI формулирует логику прямо: злоумышленники всё активнее применяют ИИ для атак, вплоть до полностью автономных, и «окно» для подготовки защитников сужается, поэтому компания хочет дать проверенным защитникам передовой интеллект раньше, чем сопоставимые наступательные возможности освоят атакующие. По утверждению OpenAI, обычная GPT-5.6 Sol уже показывает передовые результаты на кибербезопасных задачах, но системные защитные фильтры, которые должны блокировать вредоносные запросы, попутно блокируют и легитимную работу защитников, отсюда отдельный уровень доступа со снятыми ограничениями (Daybreak Blue) и специально обученная модель, которая заметно реже отказывает на явно наступательные задачи вроде разработки эксплойтов (Daybreak Red, GPT-5.6-Cyber). Показательно и то, что этой моделью уже найдены реальные, ранее неизвестные уязвимости в широко используемом софте, движке Chrome, мобильной ОС, базе данных и ядре операционной системы, то есть речь не только о лабораторных бенчмарках, но и о практическом результате.

Кому это важно

Прежде всего, авторизованным специалистам и организациям, которым доступ одобрит OpenAI: тем, кто занимается поиском уязвимостей, разбором вредоносного ПО, реагированием на инциденты, проверкой патчей и безопасной проверкой кода (набор задач Daybreak Blue), а также тем, кто ведёт авторизованные исследования уязвимостей, проверку эксплойтов и тестирование на проникновение (задачи Daybreak Red и GPT-5.6-Cyber). Косвенно это важно и всем пользователям затронутого массового софта: часть найденных моделью уязвимостей (в движке Chrome) уже исправлена Google, часть, в неназванных мобильной ОС, базе данных и ядре ОС, ещё устраняется совместно с партнёрами Daybreak и open-source-сообществом. Отдельно это касается организаций, которые уже используют Codex вместе с доступом Daybreak: им напрямую адресована рекомендация перейти на режим автоматической проверки действий.

Как это применить

Доступ к Daybreak Blue и Daybreak Red открыт только одобренным физическим лицам и организациям, ведущим авторизованную работу; OpenAI проверяет заявителей через верификацию личности, требования к безопасности аккаунта, мониторинг, ограничения по разрешённому использованию и юридические заверения. OpenAI рекомендует начинать с Daybreak Blue, он покрывает большинство защитных задач: поиск уязвимостей, разбор вредоносного ПО, реагирование на инциденты, проверку патчей и безопасную проверку кода. Daybreak Red и GPT-5.6-Cyber нужны для узкой наступательной работы вроде тестирования на проникновение боевых систем. С 1 сентября 2026 года все личные аккаунты Daybreak обязаны использовать аппаратные ключи безопасности. Пользователям Codex внутри Daybreak рекомендовано, но пока не обязательно, перейти с режима полного доступа на режим автоматической проверки действий, при котором операции с повышенными правами проверяются перед выполнением, а рискованные запросы могут блокироваться. Рекомендованные практики: работать в изолированных песочницах без доступа к боевым системам и открытому интернету и регулярно проверять границы этой изоляции; включать автоматическую проверку и человеческий контроль для рискованных сценариев; заранее чётко описывать разрешённые системы и действия через профили доступа с ограниченными правами. Организации дополнительно могут настраивать политику проверки под свои процессы. Цены и сроки открытия более широкого доступа OpenAI не раскрывает.

Можно ли доверять

Источник, официальный пост OpenAI, то есть первичный, но не независимый: все цифры (95,0% против 1,5%, результаты на ExploitGym, тесте нулевого дня, ExploitBench), из внутренних оценок компании, без стороннего аудита и без опубликованной системной карты (обещана «позже», без даты). Оценка риска по методике Preparedness Framework, тоже собственная шкала OpenAI, а не независимая экспертиза: и GPT-5.6 Sol, и GPT-5.6-Cyber по кибербезопасным возможностям отнесены к «высокому» уровню риска, но ниже «критического» порога. При этом часть заявлений можно проверить независимо: находка в движке V8, не самооценка, а реальная, ранее неизвестная уязвимость, которую подтвердила и исправила Google, присвоив ей номер CVE-2026-15903; это внешне верифицируемый результат. OpenAI также прямо отвечает на резонный вопрос читателя, не уклоняясь: явно пишет, что GPT-5.6-Cyber не имеет отношения к более раннему инциденту со взломом Hugging Face.

Риски и подводные камни

Модель с резко сниженным числом отказов на задачи вроде разработки цепочек эксплойтов и обхода аутентификации, это по определению повышенный риск при любом сбое контроля доступа или неправильном согласовании (misalignment); сама OpenAI признаёт этот риск открыто. Из технических нюансов: у второй V8-уязвимости, нужной для выхода за пределы песочницы, источник не уточняет, получила ли она отдельный номер CVE, статус исправления этой конкретной части цепочки неясен. На одном из внутренних тестов (написание отчётов об уязвимостях) GPT-5.6-Cyber уступает обычной GPT-5.6 Sol, модель, по объяснению OpenAI, иногда пишет более короткие и менее подробные отчёты, то есть узкая специализация под эксплойты не даёт превосходства во всём. Наконец, OpenAI не раскрывает ни стоимость доступа, ни сроки его расширения, ни даже точную дату публикации системной карты, оценить итоговую доступность и полноту проверки безопасности GPT-5.6-Cyber по этому посту нельзя.

«[GPT-5.6 Cyber] заметно улучшает наши специализированные процессы исследования уязвимостей: модель точнее рассуждает о реальных ограничениях эксплойтов, лучше отслеживает сложное состояние системы и закрывает менее чем за день работу, которую более ранние модели не решали неделями прерывистых попыток. В управляемой среде Trusted Access сокращение лишних отказов помогает авторизованным исследователям сохранять темп и тратить больше времени на проверку находок и превращение их в защитную ценность.»

— неназванный клиент-партнёр OpenAI, один из ранних пользователей GPT-5.6-Cyber