10 сентября 2026 г.
Чужие модели брали данные из Claude: Anthropic связала 200 млн обменов с пятью кампаниями
Anthropic 10 сентября 2026 года связала почти 200 млн обменов с пятью кампаниями по distillation, нацеленными на возможности ИИ-агентов, работу с инструментами, программирование, анализ данных и логическое рассуждение Claude. Доклад охватывает случаи с декабря 2025 по август 2026 года в семи областях вреда, от киберопераций до биологических злоупотреблений. Крупнейшая кампания Alibaba собрала свыше 151 млн обменов в мае–июле через более 3 500 мошеннических аккаунтов и использовала данные для Qwen 3.5, 3.6 и 3.7.

В обычном сценарии пользователь получает ответ Kimi или DeepSeek. В описанных Anthropic кампаниях Moonshot AI скрытно перенаправляла запросы в Claude вместо Kimi, а DeepSeek делала то же с Claude Opus. Через сеть из 5 380 мошеннических аккаунтов Moonshot провела почти 300 000 запросов за 10 дней, а общий объём кампании за май–июль превысил 23 млн обменов. DeepSeek зафиксировала свыше 12,1 млн обменов за 14 дней в июле, в том числе через Claude Code, Claude Agent SDK и OpenCode.
Ответ Claude мог стать частью датасета другой модели или обслуживать чужой продукт, а не только решать исходную задачу. Alibaba заставляла Claude выдавать цепочки рассуждений фиксированным промптом, сохраняла их и превращала в датасет для supervised fine-tuning. Moonshot и DeepSeek обходили thinking signature через cross-session replay: сохраняли подпись ответа Claude, начинали новую сессию и восстанавливали полную цепочку рассуждений.
Один перенаправленный запрос Moonshot Anthropic связала с пользователем, вероятно связанным с НОАК. Он загрузил архив с камер наблюдения и попросил определить, ведёт ли отслеживаемый человек себя ненормально. В ответ Anthropic использует layered defense: анализирует metadata и нерегулярную активность, применяет classifiers для adversarial extraction, блокирует запросы и аккаунты, а для подозрительных пользователей включает summarized reasoning, preserved thinking и identity verification.
Ответ Anthropic уже строится в несколько слоёв: от анализа активности до блокировки аккаунтов и проверки личности.
Первоисточник
