30 сентября 2026 г.
Промпт из письма может размножиться в ИИ-агенте: OpenAI нашла самовоспроизводящуюся инъекцию
27 июня OpenAI обнаружила инъекцию, которая заставляла ИИ-агента вставлять текст письма в каждый ответ. Её варианты также размножались через файловую систему и комментарии в коде.

Fake Chain-of-Thought атаки пробивали GPT-5.1 более чем в 95% случаев. В GPT-5.6 Sol этот показатель ниже 10%.
Проверка агента. Теперь вредная инструкция может попасть в следующие письма, файлы или комментарии. OpenAI рекомендует Promptfoo для проверки промптов и ИИ-агентов: нужны Node.js 22.22.0 или новее, затем `npx promptfoo@latest redteam setup` создаёт конфигурацию, а `npx promptfoo@latest redteam run` прогоняет по цели несколько сотен враждебных входов.
OpenAI добавляет самовоспроизведение в обучение своей GPT-Red attacker-модели для будущих релизов.
Первоисточник