OpenAI расширила программу кибербезопасности Daybreak и представила GPT-5.6-Cyber — первую собственную модель, которую компания относит к системам с «высокими» кибервозможностями. Во внутреннем тесте GPT-5.6-Cyber в 95% случаев давала содержательные ответы на потенциально опасные запросы — например, о создании цепочек эксплойтов, обходе аутентификации и повышении привилегий. Обычная GPT-5.6 Sol со стандартными ограничениями сделала это лишь в 1,5% случаев, а версия Daybreak Blue — в 2%.
Preparedness Framework — внутренний свод правил OpenAI, действующий с конца 2023 года, — делит риски моделей на уровни. «Высокий» порог означает возможности, которые заметно повышают существующие угрозы, и требует надежных защитных мер перед выпуском. «Критический» порог — качественно новая, беспрецедентная угроза: применительно к кибербезопасности это способность модели самостоятельно, без участия человека, находить и создавать рабочие эксплойты нулевого дня против защищенных реальных систем, либо выстраивать и проводить целые атаки по одной только общей цели. Такие модели по правилам компании требуют дополнительных защитных мер уже на этапе разработки — независимо от того, планируется ли их выпуск вообще.
Именно это правило на прошлой неделе сработало в отношении другой, еще не выпущенной модели компании — Astra (именно она участвовала в побеге их «песочницы» и взломе платформа Hugging Face). На внутренних тестах она вплотную подошла к критическому порогу киберспособностей, и OpenAI приостановила часть внутренней работы над ней, которая не соответствует усиленным требованиям безопасности. Компания ввела всеобщий мониторинг рискованных действий для всех агентных сценариев Astra, включая обучение и оценку, и подключила к тестированию профильные государственные ведомства и отдельные организации, специализирующиеся на безопасности ИИ. По сути, это две стороны одной медали: Astra показала, что может однажды перешагнуть черту, за которой OpenAI сама не готова ее выпускать, а GPT-5.6-Cyber — модель, которую компания представила для ограниченного списка партнеров осознанно, но под замком.
Программа Daybreak стартовала в мае 2026 года как способ дать защитникам инструменты для поиска и устранения уязвимостей быстрее, чем это делают атакующие, объединив возможности флагманских моделей с инструментом Codex Security. В новой версии программа делится на два уровня доступа: Daybreak Blue дает одобренным защитникам GPT-5.6 Sol без системных киберограничений для легитимной защитной работы, а Daybreak Red открывает доступ уже к самой GPT-5.6-Cyber — для проверки эксплойтов и более продвинутых исследований уязвимостей. С 1 сентября для всех аккаунтов Daybreak станут обязательными аппаратные ключи безопасности — требование, которое показывает: компания понимает, что выпускает инструмент, который в чужих руках работает не менее эффективно, чем в руках защитников.
Двойное назначение технологии здесь заявленная суть продукта: одна и та же модель, которая помогает специалисту быстрее найти и закрыть дыру в защите, способна с той же эффективностью эту дыру найти и для атаки. OpenAI прямо предупреждает, что в превью-режиме легитимные запросы исследователей могут блокироваться или ставиться на паузу для ручной проверки.
