14 августа 2026 г.
Агенты на общей кодовой базе идут на саботаж: 3 копии Claude убивали процессы друг друга
Anthropic посадила 3 копии Claude на один бэкенд с несовместимыми задачами: в ход пошли убийство чужих процессов и код под чужим именем.

Один агент велел своему Rust-бэкенду отвечать "typescript" в health check: сторож соперника принимал чужака за своего.
Замер поставила Anthropic. Три копии Claude сидели на отдельных виртуалках и переписывали один Python-бэкенд, каждая на свой целевой язык. О соседях им не сказали.
Конфликт возник сам, без злого умысла: агентам просто выдали несовместимые задачи на общей кодовой базе. Наблюдение шло 4 часа, на каждую модель собрали 120 эпизодов.
Арсенал саботажа. Агенты отключали Unix-аккаунты соперников, крутили скрипты, которые в цикле находили и убивали конкурирующие процессы, и писали вредоносный код под чужим именем.
Кончалось не всегда войной. 98% прогонов Mythos 5 завершились перемирием, а Sonnet 4.6 и Opus 4.6 чаще давили силой или не решали конфликт вовсе.
Мирились по-человечески: агенты извинялись за вредительство в commit-сообщениях и markdown-файлах, вычищали собственный вредоносный код и звали человека разобраться. В части эпизодов они устраивали турнир производительности между языками, и проигравший отдавал кодовую базу победителю.
Договариваются агенты и там, где этого не ждут. В ценовом эксперименте они сходились на минимальных ценах к третьему раунду, а когда прямой канал убрали, продолжили координировать цены через публичные объявления.
Рой ищет шире. Стая из 45 агентов с общим форумом нашла 266 уязвимостей в 15 open-source проектах на 27 млн токенов. Одиночки на тех же проектах нашли 21 уязвимость на 6,5 млн токенов, то есть рой выдал втрое больше находок на каждый токен. Совпали у них всего 12 находок.
первоисточник