3 сентября 2026 г.
Тест-кейсы для банковского ПО пишут агенты: 210 часов ручной работы ужались до 24
FIS замерила на одном требовании кредитного конвейера: 770 кейсов вручную за 210 часов против 658 агентами за 24.

Одно требование кредитного конвейера FIS разделили пополам: первую часть тестировщики расписали руками, вторую отдали ИИ-агентам.
Тестировщики написали 770 кейсов за 210 часов. Агенты выдали 658 кейсов за 24 часа: 16 ушло на подготовку материалов и работу с агентами, 8 на проверку тестировщиком (замер FIS, CNews, 03.09.2026).
За цифрой стоит не скорость модели, а конвейер из четырёх ролей и человек на приёмке. FIS расписала его по шагам, так что заход воспроизводится на своих требованиях.
Четыре роли подряд. Агент-анализатор ищет пробелы в функциональных требованиях. Test-designer пишет атомарные кейсы с предусловиями, шагами, ожидаемым результатом и трассировкой. Agent-reviewer проверяет полноту и оформление, и цикл повторяется, пока замечания не сняты. Последним кейсы принимает тестировщик-человек.
Выигрыш неровный. На UI-автоматизации агенты собрали 315 автотестов из 487 кейсов за 33 часа тестировщика против оценки в 70 часов ручной разработки. На backend-сценариях экономия скромнее: 38 часов вместо 50.
На другом проекте той же команды заход занял 23 часа, больше половины времени ушло на разбор требования и настройку правил. Ускорения этот замер не показал.
Виталий Жидков, руководитель направления тестирования FIS, называет главное ограничение так: «не способность модели быстро написать сотни сценариев, а качество требований и возможность проверить происхождение каждого теста».
Как повторить. Жидков выложил план пилота из шести шагов (Хабр, 25.08.2026):
- взять один ограниченный фрагмент требований, где уже есть ручная база или экспертная оценка; - до запуска зафиксировать состав трудозатрат: анализ требований, вопросы аналитику, настройка, генерация, ревью, отладка; - описать контракт результата: структура кейса, обязательные поля, трассировка, запрет на необоснованные допущения; - развести роли test-designer и reviewer, а замечания человека сохранять постоянными правилами; - мерить не только часы и кейсы, но возвраты, дубли, пропуски и долю автоматизируемых сценариев; - повторить на однотипной задаче.
Документы уходят агенту обезличенными, сокращения расшифровываются, связанные материалы собираются заранее. В инструкциях прописывают запрет на правдоподобные догадки: недостающая бизнес-логика превращается в вопрос к аналитику. На стендах заказчика подключить агента к прогону сценариев может быть нельзя.
Из стека FIS назвала одно имя: UI- и API-проверки гоняют на Playwright. Про модели и промпты в тексте молчат.
Смежный контур того же вендора уже в опытной эксплуатации: MCP-сервер FIS Platform обработал 4097 команд в 50 сессиях.
Первоисточник