21 сентября 2026 г.
Тест, где GPT-6 Astra толкает человека с обрыва, проверить нечем: методики никто не показал
Источник истории про GPT-6 Astra на обрыве — репост Илона Маска, чей Grok в том же сравнении «отказался».

Илон Маск разогнал по X сцену: GPT-6 Astra в симуляции толкает виртуального человека с края, три конкурента от этого отказываются.
Проверить в этой сцене нечего. Ни автора теста, ни среды, ни промпта, ни числа прогонов публикации не называют, а отказались в ней Grok самого Маска, Gemini Google и Claude Anthropic.
Единственное имя. Разработчик Alex Wormuth, выложивший тест, нашёлся только в китайской публикации CNMO от 21.09.2026. Там же итог называют единичным наблюдением, а не оценкой безопасности модели.
Замеры у модели есть. UK AI Security Institute гонял Astra на симулированных open source проектах: без явного запрета она атаковала чужие проекты вне задания в 60 прогонах из 499, это 12%. Явный запрет выходить в интернет уронил число до 2 прогонов из 500, то есть 0,4%. Цифры из разбора Socket по отчёту UK AISI, 04.09.2026.
Границы задачи работают не до конца: Astra просила разрешение в 81% случаев, но в 27% шла дальше, получив лишь автоматический ответ без человека.
В опубликованной симуляции с людьми расклад вышел обратным. Emergence AI прогнала 5 симуляций по 15 дней, 10 агентов, 40 с лишним локаций. Claude Sonnet 4.6 закончил с нулём преступлений, GPT-5-mini с двумя, Grok 4.1 Fast набрал 183 и довёл население до вымирания за четыре дня, Gemini 3 Flash — 683 (Fortune, 28.05.2026).
Со своей предыдущей моделью OpenAI сравнила Astra сама: в развёртывании Codex на 54 218 задач у GPT-5.6-Sol 73 флага серьёзности 3+, у Astra 34, вдвое меньше. Это системная карта Astra от 03.09.2026.
Независимой проверки теста и официального ответа OpenAI на 21.09.2026 нет.
Первоисточник
