Перейти к основному содержанию
OpenAI представила GPT-5.5-Cyber: модель превзошла Claude Mythos 5 в тестах по кибербезопасности

OpenAI представила GPT-5.5-Cyber: модель превзошла Claude Mythos 5 в тестах по кибербезопасности

Компания OpenAI объявила о масштабном расширении своей инициативы Daybreak, направленной на помощь специалистам по информационной безопасности в поиске, проверке и устранении программных уязвимостей на ранних этапах разработки.

OpenAI представила GPT-5.5-Cyber: модель превзошла Claude Mythos 5 в тестах по кибербезопасности

Одновременно компания представила полноценную версию специализированной модели GPT-5.5-Cyber, предназначенной для задач кибербезопасности. Согласно опубликованным результатам тестирования, модель превзошла Claude Mythos 5 по ряду профильных показателей.

ИИ ускорил поиск уязвимостей, но проблема сместилась к их исправлению

В OpenAI отмечают, что современные модели искусственного интеллекта значительно ускорили процесс обнаружения уязвимостей. Однако основной сложностью для отрасли становится не поиск проблем, а их последующая обработка.

После выявления потенциальной угрозы разработчикам необходимо:

  • подтвердить наличие уязвимости;
  • оценить ее влияние;
  • подготовить исправление;
  • протестировать изменения;
  • выпустить обновление.

Для решения этих задач OpenAI продолжает развивать платформу Daybreak.

Codex Security проверил более 30 миллионов коммитов

В марте компания запустила предварительную версию Codex Security — инструмента, использующего агентные механизмы рассуждения и автоматическую проверку найденных проблем.

С момента запуска система проанализировала более 30 миллионов коммитов в свыше 30 тысячах репозиториев.

По данным OpenAI:

  • более 70 тысяч обнаруженных проблем были помечены специалистами как исправленные;
  • свыше 500 тысяч находок система автоматически определила как устраненные.

Новый плагин Codex Security получил расширенные возможности

Вместе с обновлением Daybreak компания представила новую версию плагина Codex Security.

Инструмент способен выполнять:

  • глубокое сканирование кода;
  • анализ последних изменений;
  • подготовку отчетов по безопасности;
  • построение цепочек потенциальных атак;
  • проверку найденных уязвимостей;
  • создание исправлений для последующей проверки человеком.

Кроме того, система может обрабатывать данные из существующих сканеров безопасности, бюллетеней, программ поиска ошибок и систем управления задачами.

Поддерживается экспорт результатов в системы управления уязвимостями, а также интеграция через:

  • SARIF;
  • запросы CodeQL;
  • Codex CLI;
  • приложение Codex.

GPT-5.5-Cyber показала лучшие результаты в профильных тестах

В мае OpenAI представила предварительную версию GPT-5.5-Cyber, созданную на базе модели GPT-5.5 специально для задач информационной безопасности.

Теперь компания открыла ограниченный доступ к полной версии модели для проверенных специалистов по безопасности.

В тесте CyberGym новая модель набрала 85,6%, тогда как:

  • GPT-5.5 получила 81,8%;
  • Claude Mythos 5 — 83,8%.

В тесте ExploitGym результаты составили:

  • GPT-5.5-Cyber — 39,5%;
  • GPT-5.5 — 25,95%.

В бенчмарке SEC-bench Pro модель показала результат 69,8% против 63,1% у базовой GPT-5.5.

Таким образом, GPT-5.5-Cyber продемонстрировала более высокую эффективность как по сравнению с основной моделью OpenAI, так и по сравнению с Claude Mythos 5 в отдельных сценариях анализа безопасности.

OpenAI запускает партнерскую программу Daybreak Cyber

Компания также объявила о создании программы Daybreak Cyber Partner Program, которая позволит поставщикам решений и сервисов в области кибербезопасности использовать GPT-5.5 через механизм Trusted Access for Cyber.

В число первых партнеров вошли:

  • Accenture;
  • Akamai;
  • Cisco;
  • Cloudflare;
  • CrowdStrike;
  • IBM;
  • Palo Alto Networks;
  • Proofpoint;
  • SentinelOne;
  • Wiz;
  • Zscaler.

Более 30 проектов с открытым исходным кодом присоединились к инициативе Patch the Planet

Еще одним направлением расширения Daybreak стала программа Patch the Planet, которую OpenAI запускает совместно с компаниями и исследователями, включая Trail of Bits, HackerOne и Calif.

К инициативе уже присоединились более 30 проектов с открытым исходным кодом, среди которых:

  • cURL;
  • Go;
  • Python;
  • Sigstore;
  • pyca/cryptography.

Проект нацелен на ускорение выявления и устранения уязвимостей в критически важных открытых программных компонентах с использованием инструментов искусственного интеллекта.