2 сентября 2026 г.
ИИ вскрывает системы без промахов: Astra берёт 100% на тесте ExploitBench
OpenAI выпустила Astra 3 сентября, а навыки взлома закрыла программой Daybreak: доступ дают по заявке от организации.
На тесте взлома ExploitBench Astra закрыла все задачи: 100% против 78,5% у прошлой модели GPT-5.6 Sol.
Поэтому кибернавыки OpenAI вынесла в отдельный контур. Сама модель gpt-6-astra вышла 3 сентября и открылась аккаунтам ChatGPT и API, а искать и проверять эксплойты умеет только внутри закрытой программы.
На ExploitGym Astra даёт 42,4% против 30,3% у Sol. На реверс-инжиниринге SRE-Bench она решает 99,2% за четыре попытки, у Sol было 68,7%.
Доступ по заявке. В Daybreak два тира. Blue отвечает за защитные задачи, Red проверяет эксплойты. Организация подаёт форму на сайте OpenAI, и одобрение не автоматическое. С 13 августа оба тира работают в Amazon Bedrock, единственный регион US East (Ohio), а данные инференса не идут в обучение.
Базовая Astra в API стоит $10 за миллион входных токенов и $50 за миллион выходных. Контекст 1 050 000 токенов, но запрос длиннее 272 тысяч тарифицируется по удвоенной цене входа целиком, а не только на превышение.
Замеры расходятся. У Artificial Analysis Astra набирает 61 балл интеллекта, на 5 пунктов ниже Claude Fable 5.1. По индексу агентов для кода она обходит Sol на 2 пункта при сравнимой цене. Видна и разница стендов: на ARC-AGI 3 модель показывает 99,9% на собственном харнессе OpenAI и 62,7% на дефолтном.
Пока кибертир закрыт заявкой, сторонних замеров взлома у Astra не появится.
Первоисточник