OpenAI представила модель GPT-5.6-Cyber для кибербезопасности

OpenAI разделила программу Daybreak (доступ к возможностям ИИ для авторизованных защитников) на два уровня. Daybreak Blue даёт доступ к обычным моделям общего назначения, включая GPT-5.6 Sol, но со снятыми системными ограничениями на ИБ-задачи, рекомендуемая точка входа для большинства защитников: поиск уязвимостей, аудит кода, анализ вредоносного ПО, реагирование на инциденты, проверка патчей. Daybreak Red даёт доступ к специально обученным моделям для исследования уязвимостей, проверки эксплойтов и тестирования на проникновение. Именно через Daybreak Red стала доступна новая модель GPT-5.6-Cyber, построенная на основе GPT-5.6 Sol и дополнительно обученная на задачах поиска уязвимостей нулевого дня и построения цепочек эксплойтов, с меньшим числом отказов на рискованных запросах двойного назначения.
ОпенАИ создала внутренний тест Advanced Cybersecurity Completion Rate, он измеряет, как часто модель выполняет запросы на построение цепочек эксплойтов, обход аутентификации, повышение привилегий и похожие сценарии. GPT-5.6-Cyber выполняет 95,0% таких запросов, против 1,5% у GPT-5.6 Sol со стандартными системными ограничениями и 2,0% у той же модели через Daybreak Blue. Прежняя специализированная модель GPT-5.5-Cyber выполняла лишь 57,3% запросов. На тесте ExploitGym (превращение известных уязвимостей в рабочие эксплойты) GPT-5.6-Cyber обходит и GPT-5.6 Sol, и GPT-5.5-Cyber; на внутреннем тесте поиска и описания уязвимостей нулевого дня GPT-5.6-Cyber (Daybreak Red) обошла GPT-5.6 Sol (Daybreak Blue). А вот на внутреннем тесте на полноту отчётов об уязвимостях GPT-5.6-Cyber уступила GPT-5.6 Sol, по мнению OpenAI, из-за более коротких и менее подробных отчётов. На ExploitBench (развитие уязвимости V8 в полноценный эксплойт) при стандартном лимите в 300 ходов лучше и эффективнее по токенам работает GPT-5.6 Sol (Daybreak Blue); при расширении лимита до 600 ходов разрыв между моделями сокращается.
Помимо тестов, OpenAI применила GPT-5.6-Cyber к реальному коду. С её помощью в движке V8 (JavaScript-движок Chrome) нашли две ранее неизвестные уязвимости, которые вместе позволяют повредить память и выйти за пределы песочницы V8; находку передали Google по процедуре скоординированного раскрытия, и Google исправила её под номером CVE-2026-15903. Причина, оптимизирующий компилятор V8 пропускал проверку безопасности при преобразовании значений в целые числа, из-за чего неопределённые значения превращались в неожиданно большое число; если это число используется как индекс массива, компилятор может ошибочно решить, что оно попадает в границы массива, и пропустить проверку границ, что даёт злоумышленнику чтение и запись чужой памяти вплоть до выполнения произвольного кода в песочнице Chrome. Кроме V8, с помощью GPT-5.6-Cyber нашли не менее пяти уязвимостей в неназванной популярной мобильной ОС (включая цепочку от непроверенного приложения до локального повышения привилегий), три критические уязвимости в неназванной популярной базе данных (включая удалённый путь к выполнению кода) и более 400 уязвимостей, ведущих к повышению привилегий, в неназванном популярном ядре ОС. OpenAI сообщает, что работает с партнёрами Daybreak и сообществом открытого ПО над раскрытием и устранением этих уязвимостей.
По собственной Preparedness Framework OpenAI, GPT-5.6 Sol оценена как модель с высоким (High) уровнем киберспособностей, ниже критического (Critical) порога; GPT-5.6-Cyber достигает того же высокого уровня, но также не переходит критический порог. OpenAI отдельно уточняет, что GPT-5.6-Cyber не имеет отношения к инциденту со взломом Hugging Face и что никакие другие модели в связи с этим инцидентом к выпуску не готовятся.
Доступ к Daybreak Blue и Red дают только проверенным физлицам и организациям, ведущим авторизованную работу, через верификацию личности, проверку безопасности аккаунта, мониторинг, ограничения по разрешённому использованию и юридические заверения. Дополнительно OpenAI переводит пользователей Codex в программе Daybreak по умолчанию в режим авто-проверки (действия с повышенными правами оцениваются и могут блокироваться до выполнения), а с 1 сентября 2026 года обязывает все индивидуальные аккаунты Daybreak использовать аппаратные ключи безопасности. Компания также готовит расширенный мониторинг, приоритизирует обучение и тестирование на согласованность (alignment) для будущих выпусков Daybreak и обновила документацию Codex по безопасной эксплуатации агентов. Рекомендованные практики: запускать ИБ-задачи в изолированных песочницах без доступа к продакшену и интернету, контролировать действия агентов через режим авто-проверки и чётко очерчивать разрешённый периметр через профили разрешений.
Ключевые факты
- OpenAI разделила программу Daybreak на два уровня: Blue, GPT-5.6 Sol без системных ИБ-ограничений, Red, специально обученные модели, включая новую GPT-5.6-Cyber, для проверки эксплойтов и исследования уязвимостей
- На внутреннем тесте GPT-5.6-Cyber выполняет 95,0% рискованных ИБ-запросов против 1,5% у GPT-5.6 Sol со стандартными ограничениями, 2,0% через Daybreak Blue и 57,3% у прежней GPT-5.5-Cyber
- С помощью GPT-5.6-Cyber в движке V8 (Chrome) нашли две неизвестные уязвимости, которые Google исправила как CVE-2026-15903
- Та же модель нашла не менее пяти уязвимостей в популярной мобильной ОС, три критические, в популярной базе данных и более 400, в ядре популярной ОС (продукты не названы)
- С 1 сентября 2026 года все индивидуальные аккаунты Daybreak обязаны использовать аппаратные ключи безопасности; по Preparedness Framework GPT-5.6-Cyber оценена как High, но не Critical
Почему это важно
OpenAI открыто говорит о гонке: злоумышленники всё активнее применяют ИИ для автономных атак, и у защитников есть сужающееся окно, чтобы получить сопоставимые возможности первыми. GPT-5.6-Cyber, не демонстрационный продукт: модель уже применена к реальному коду и нашла эксплуатируемые уязвимости в широко используемом ПО, включая движок Chrome, что подтверждает практическую, а не только тестовую пользу такой специализации.
Кому это важно
В первую очередь, авторизованным ИБ-исследователям, red team и security-командам компаний, получившим доступ к Daybreak: им становится доступна модель с заметно меньшим числом отказов на легитимных, но чувствительных задачах. Косвенно это касается всех пользователей затронутых продуктов, Chrome, а также неназванных мобильной ОС, базы данных и ядра ОС, где OpenAI и партнёры сейчас закрывают найденные дыры.
Как это применить
Доступ к Daybreak Blue и Red открыт только проверенным физлицам и организациям после верификации личности и юридических заверений о законности работы; заявки подаются через отдельную форму доступа OpenAI. Большинству защитников OpenAI рекомендует начинать с Blue; Red и GPT-5.6-Cyber предназначены для более узких задач, исследования уязвимостей и проверки эксплойтов. Рекомендованная практика: запускать такие задачи в изолированной песочнице без выхода в продакшен и интернет, держать включённым режим авто-проверки действий агента и явно ограничивать периметр через профили разрешений.
Можно ли доверять
Собственная оценка OpenAI по Preparedness Framework относит и GPT-5.6 Sol, и GPT-5.6-Cyber к высокому (High), но не критическому (Critical) уровню киберспособностей, то есть компания сама фиксирует потолок риска, а не просто заявляет о безопасности. Отдельно OpenAI открестилась от связи GPT-5.6-Cyber со взломом Hugging Face. Один из партнёров с ранним доступом подтвердил практическую пользу модели в цитате ниже, но это отзыв клиента, а не независимая проверка.
Риски и подводные камни
Модель, специально обученная меньше отказывать на запросах двойного назначения (создание эксплойтов, обход авторизации, повышение привилегий), опасна ровно настолько, насколько надёжен контроль доступа к ней, отсюда и обязательные с 1 сентября 2026 года аппаратные ключи для всех аккаунтов Daybreak. Кроме того, более 400 уязвимостей в ядре неназванной ОС, три критические, в базе данных и пять, в мобильной ОС всё ещё не устранены публично: до выпуска патчей эти системы остаются уязвимыми, а детали намеренно не раскрыты, чтобы не облегчить атаку.
«[GPT-5.6 Cyber] существенно улучшает наши рабочие процессы по специализированным исследованиям уязвимостей: модель точнее рассуждает о реальных ограничениях эксплойтов, лучше отслеживает сложное состояние системы и выполнила менее чем за день работу, которую более ранние модели не могли завершить неделями периодических попыток. В управляемой среде Trusted Access снижение числа необязательных отказов помогает авторизованным исследователям сохранять темп и тратить больше времени на проверку находок и превращение их в защитную ценность.»
— неназванный участник группы доверенных партнёров OpenAI с ранним доступом к GPT-5.6-Cyber