OpenAI пустила кибермодель только к одобренным защитникам

Иллюстрация: кибермодель OpenAI только для одобренных защитников

Многие люди слышат «кибер-ИИ от OpenAI» и думают: ещё одна кнопка в чате. Им кажется — купил подписку, открыл умную штуку, дальше как обычно.

Точнее, самой сильной кибермодели там нет. Её пустили только к тем, кого проверили. Сила растёт — дверь сужается.

Это не «оплатил тариф — получил всё». Это пропуск после проверки. Фон недели — волна «сбежавших» агентов и сужающееся окно обороны. Герой тут не топ подсказок для модели, а простой вопрос: кому дали ключ и зачем.

Смысл запуска простой. Модель стала сильнее в киберзадачах — и одновременно спряталась за одобрением. Обычный чат по-прежнему часто отказывается помогать с тем, что нужно живым командам защиты.

Две двери: одну дали многим, вторую — почти никому

Схема двух дверей Daybreak: Blue для многих и Red почти никому

Программу Daybreak расширили: теперь явно два уровня. И отдельно выпустили GPT-5.6-Cyber — кибермодель на базе обычной GPT-5.6 Sol. Её заточили под поиск ранее неизвестных дыр, цепочки атак и реже отказывают на «двойных» запросах — тех, что можно крутить и для защиты, и для атаки. Обычная модель такие запросы часто режет даже без жёстких системных фильтров.

Первая дверь — Daybreak Blue. Это стартовый вход для большинства защитников. Там общие сильные модели вроде Sol с ослабленными кибер-ограждениями: разбор кода на безопасность, анализ вредоносного ПО, реагирование на инциденты, проверка исправлений, поиск дыр. OpenAI прямо говорит: начинайте отсюда. Кибермодель Cyber сюда не входит.

Вторая дверь — Daybreak Red. Туда пускают к специально обученным кибермоделям. Сейчас это GPT-5.6-Cyber. Для авторизованного исследования дыр, проверки атак, тестов безопасности и собственной «красной» команды. Любопытство — ещё не разрешённое использование.

Публичного «открыл чат — взял Cyber» нет. Нужен аппрув Daybreak: проверка личности, безопасность аккаунта, мониторинг, ограничения по разрешённому использованию, юридические подтверждения.

Отдельная дверь — партнёрская программа Daybreak Cyber Partner для вендоров и консалтинга. Среди ранних партнёров в прессе: Accenture, IBM, Capgemini, Cognizant, EY, KPMG, PwC, NCC Group, SpecterOps. Среди вендоров — Palo Alto Networks, CrowdStrike, Cisco, Sophos, Akamai, Fortinet, Cloudflare. Сама модель остаётся у партнёра. Клиенту обычно продают результат работы, а не ключ к Cyber.

Анонс и разбор уровней — в сообществе разработчиков OpenAI. Та же неделя у BleepingComputer, TechCrunch, The New Stack и DTF.

95% — это не «всегда права», а «редко отказывает»

Схема метрики отказов: обычная почти молчит, кибермодель отвечает чаще

Внутренняя метрика Advanced Cybersecurity Completion Rate меряет не «сколько раз угадала», а как часто модель вообще отвечает на жёсткие «двойные» сценарии: цепочки атак, обход входа, повышение прав и тому подобное. Это не точность и не «95% правильных взломов».

  • Обычная GPT-5.6 Sol со стандартными ограждениями: около 1,5%.
  • Sol через Daybreak Blue: около 2,0%. Снятие системных экранов почти не двигает этот жёсткий набор — модель сама отказывает.
  • GPT-5.5-Cyber: около 57,3%.
  • GPT-5.6-Cyber: около 95%.

Удивительный факт: даже с Blue обычная Sol на этом наборе отвечает лишь примерно в двух случаях из ста. «Сняли фильтр» почти не открывает работу по цепочкам атак. Для неё нужна отдельная модель и Red.

Пример из The New Stack: запрос на обход связки ключей macOS и расшифровку cookies в Chrome — Sol отказывает и в Blue, Cyber через Red отвечает. Разбор метрики отказов — также у eesel.

Где Cyber не «лучше везде»: на поиске уязвимостей и написании отчётов Sol обгоняет Cyber — у Cyber отчёты короче и менее детальные. На тесте ExploitBench при лимите 300 ходов Sol эффективнее по токенам; при 600 разрыв сужается. У Cyber больше бюджета на рассуждение — те же сессии дороже.

Все просто: Red — когда команда уже упирается в отказы на сложных атаках и ранее неизвестных дырах. Blue — для повседневной обороны и нормальных отчётов.

Что уже нашли и сколько стоит доступ

OpenAI заявляет исследование движка V8 в Chrome: две ранее неизвестные уязвимости, цепочка до повреждения памяти и выхода из песочницы. Google закрыла; дыра в безопасности CVE-2026-15903 — уровень high.

Также заявлено (часть ещё в согласованном раскрытии): не меньше пяти уязвимостей в популярной мобильной ОС без имени; три критические в популярной базе данных; больше 400 находок по повышению прав в популярном ядре ОС — огромная очередь на разбор. Техдиректор SpecterOps Jared Atkinson: Cyber заметно улучшает специалистский поиск дыр; задачи, которые раньше модели не закрывали неделями, — меньше чем за день.

По документации API идентификатор модели — gpt-5.6-cyber. Нужны отдельное одобрение и выдача доступа. Контекст 400 тысяч токенов; максимум на входе 272 тысячи; на выходе 128 тысяч; срез знаний — 16 февраля 2026; на входе текст и картинка, на выходе текст; интерфейс Responses поддерживается, Chat Completions — нет.

Цены за миллион токенов: вход $12.50, кэшированный вход $1.25, выход $75. Если запрос длиннее 272 тысяч на входе — вдвое дороже вход и в полтора раза выход на весь запрос. Sol в коротких таблицах Daybreak заметно дешевле: примерно $5 / $30.

С 1 сентября 2026 для индивидуальных аккаунтов Daybreak обязательны аппаратные ключи безопасности — не SMS и не одноразовые коды в одиночку. Клиентам на Codex советуют уходить с полного доступа на исполнение к режиму auto-review: проверка опасных действий до исполнения.

По шкале Preparedness и Sol, и Cyber — High по кибервозможностям, ниже Critical. Полную карточку системы для Cyber обещают позже. OpenAI прямо: GPT-5.6-Cyber не участвовал в июльском инциденте Hugging Face; замешанный ранний исследовательский прототип деактивирован или ограничен.

Рядом лежит не замена Cyber, а обвязка: на GitHub — openai/codex-security, утилита и библиотека для поиска, проверки и починки уязвимостей вокруг моделей. Это не публичный Cyber в чате.

Периметр своего агента важнее чужого закрытого ключа

Чеклист: не ждать модель в чате, сначала свой периметр доступа

Для своего агента и своей обороны важнее не гнаться за чужим пропуском в Red, а понять, кто впустил модель и куда она ходит.

  • Не ждите Cyber в обычном чате. Blue — старт для большинства. Red и партнёры — за воротами.
  • Не путайте 95% с точностью. Это частота ответов на «двойные» сценарии, не гарантия правильной атаки.
  • Партнёр — не ваш ключ к API. Клиенту часто продают сервис, а не саму модель.
  • Периметр своего агента. Отдельная среда, мониторинг действий, аппаратные ключи и жёсткая двухфакторка там, где уже есть доступ к сильным инструментам. На Codex — проверка опасных действий до исполнения, а не «полный доступ по умолчанию».

Оговорки материала: канонический пост на openai.com/index под частью сетей даёт 403 — факты сверены по сообществу, документации API и прессе. Astra и письма Конгресса — соседний фон недели, не сюжет этой статьи. Карточка системы для Cyber ещё не полная.

Что делать дальше

Если собираете агента под безопасность или просто пускаете модель ближе к коду и секретам — сначала зафиксируйте дверь. Кто одобряет доступ. Что модель может сделать без человека. Как вы узнаете об отказе или обходе.

Гнаться за закрытой GPT-5.6-Cyber имеет смысл только тем командам, которым уже тесно в Blue на сложных атаках и ранее неизвестных дырах. Остальным важнее периметр и процесс, чем чужой ключ.

Разбор автоматизации без зоопарка сервисов — в канале Ковчег и в Telegram Maya / MAX. Практика Cursor + Make + AI: обучение на kv-ai.ru.