9 сентября 2026 г.
Первым на алерт в CI отвечает ИИ: Claude выдаёт разбор инцидента за 14 минут
Anthropic выложила сетап своего дежурного: Claude пишет первый разбор инцидента за 14 минут, у инженера на это уходил час.

ClaudeDevs
@claudedevs
Первый на линии в дежурстве нашей CI-команды — Claude Tag. Он читает алерты, метрики и логи, потом пишет SITREP и по ходу ведёт lessons.md. Мы выкладываем свой сетап, вместе с шаблоном и скиллами, и надеемся, что вашей команде он пригодится так же, как нам:
· 12,1 тыс. просмотров
Claude дежурит по сбоям CI в Anthropic несколько месяцев и ведёт себе файл памяти: что сломалось, почему и что запомнить.
Этот сетап компания выложила целиком. Репозиторий anthropics/oncall-kit под Apache-2.0 открыт 18.08.2026, файлы копируются в свой репозиторий, дальше в Slack-канале зовут @Claude и просят его выполнить скилл oncall-setup, а тот доводит установку до конца сам.
Замер простой. Раньше на разбор одного сбоя у дежурного инженера уходил час. Теперь половина разборов Claude укладывается в 14 минут, лучшие — в 4. Человек проверяет готовый диагноз с доказательствами, а не собирает его с нуля.
В ките четыре скилла: triage разбирает алерт, handoff передаёт недельную смену, weather пишет статус-отчёт, oncall-setup ставит всё остальное. Установка сама генерирует карту инструментов STACK.md, политику дежурства ONCALL.md и журналы вызовов и покрытия алертов.
Память дежурства лежит в файле lessons.md. Claude дописывает туда, что случилось, в чём корневая причина и какой фикс сработал, и каждое новое расследование начинает с чтения этого файла. Поверх лежат скиллы под классы багов: под shadow divergence написан скилл на 617 строк.
Пощупать можно за 10 минут. Клонировать репозиторий, открыть его в Claude Code и вставить одну инструкцию из test-fixtures/RUNBOOK.md. Прогон идёт по вымышленной истории из 48 инцидентов, ни одного реального подключения для этого не нужно.
Боевая установка требует большего. Нужен план Claude Team или Enterprise, потому что Claude Tag работает участником Slack-канала только там. Плюс read-only-доступ к пяти вещам: метрики, хранилище логов, код-хостинг, пейджер и каналы алертов.
Установка идёт пятью фазами, и каждую подписывает человек. Фаза Mine вычитывает 30–90 дней истории инцидентов и пишет черновики плейбуков, фаза Validate переигрывает 5–10 отложенных инцидентов и требует не меньше 70% пройденных при нуле вредных ответов. Суммарно два часа человеческого времени, почти всё уходит на вычитку.
Чинит по-прежнему человек: авто-митигаций в ките нет по конструкции, инцидент закрывает и фикс деплоит инженер.
Первые две недели кит велит держать в shadow mode: диагнозы уходят в отдельный канал, и каждый читает человек.
* Meta Platforms Inc. признана в РФ экстремистской организацией, её деятельность запрещена; Facebook и Instagram заблокированы. Meta AI и другие продукты компании — продукты этой организации.
Первоисточник

