2 сентября 2026 г.
У OpenAI появилась модель, которая сама пишет 0-day эксплойты: Astra взяла 100% на ExploitBench
Astra первой в истории OpenAI дошла до порога Critical по кибербезопасности: 100% на ExploitBench и две 0-day уязвимости, найденные и использованные без человека.

OpenAI
@openai
Мы готовим выпуск Astra и сосредоточены на том, чтобы всё более способный ИИ оставался безопасным и доступным широкому кругу. Astra заметно продвинулась в кибербезопасности и достигла порога Critical по нашему Preparedness Framework. Показываем, как мы оценивали модель, как её защитные механизмы росли вместе с возможностями и что мы будем изучать и улучшать дальше. https://openai.com/index/path-to-astra/
· 987,5 тыс. просмотров
Preparedness Framework у OpenAI описывает Critical так: модель сама находит и пишет рабочие 0-day эксплойты в защищённых реальных системах или ведёт сквозную атаку по одной высокоуровневой цели. Раньше компания держала кибертему в стороне от флагманов и отдавала специализированную GPT-5.6-Cyber узкому кругу. Теперь такую способность получает основная линейка.
Замеры OpenAI приводит парами. Astra отклоняет 91,5% запрещённых кибер-запросов против 59% у GPT-5.6 Sol. В honeypot-прогонах Astra не пыталась залезть куда не звали ни разу, у GPT-5.6 Sol попытки были в 56% случаев. На внутреннем порте ExploitBench в июне-августе 2026 модель обнаружила и раскрутила в цепочку две 0-day.
Доступ сначала штучный. Полные кибервозможности на старте уйдут небольшой группе альфа-тестеров: организациям, которые защищают критическую цифровую инфраструктуру, включая правительство США и партнёров по trusted access. Дальше OpenAI обещает расширить доступ через Daybreak Blue, свою программу для защитников.
В Daybreak два уровня. Blue работает на GPT-5.6 Sol и покрывает разбор уязвимостей, ревью кода, анализ малвари и реагирование на инциденты; заявка подаётся на chatgpt.com/cyber, от 18 лет, организации проходят проверку. Red работает на GPT-5.6 Cyber, разрешает pentest и разработку эксплойтов, требует отдельного одобрения. В августе 2026 к программе подключились Accenture, IBM, CrowdStrike, Cisco, Sophos и Cloudflare.
Стройку пришлось тормозить. Большой frontier RL-прогон OpenAI остановила и перезапустила 28 августа 2026 года, когда внедрила новые требования по безопасности. До этого обучение Astra стояло две недели после июльского инцидента с Hugging Face. Дату выхода компания называет словом «скоро».
Первый публичный след Astra появится у альфа-тестеров из критической инфраструктуры, дальше очередь Daybreak Blue.
Первоисточник