29 июля 2026 г.
Советы «как распознать дипфейк» не работают: за голосом сидит живой человек с конвертером
Голосовой вишинг - это не бот с клонированным голосом, а живой оператор, который говорит через конвертер голоса в реальном времени. Так 29 июля схему описал инженер, который строит симуляторы таких атак. Он выложил бесплатное демо: без регистрации, 60 секунд на попытку, 5 фиксированных личностей, конвертацию тянут 8 облачных GPU, поэтому будет очередь. Рядом второе демо - подмена лица на видео.

Почему это важно: Инструкции по распознаванию учат ловить артефакты синтеза: плоская интонация, ровное дыхание, странные паузы, задержка перед ответом. Все эти признаки родом из text-to-speech, где текст произносит машина. При конверсии голоса говорит человек: интонация, дыхание, паузы и реакция на перебивание остаются живыми, меняется только тембр. Чек-лист ловит вчерашний способ атаки. Свои личности в демо автор зафиксировал специально и вшил в звук артефакты, чтобы запись нельзя было унести и применить. Сколько людей проваливают тест на самом деле, он не меряет, а симуляторы вишинга продаёт - про конфликт интересов сказал сам.
Не хотите разбираться сами? Внедряем ИИ в ваш бизнес: задачи без лимита, одна цена в месяц, отмена в любой момент.
Что дальше: Взять 60-секундный сэмпл из демо и дать послушать своей команде: посчитать, сколько человек назовут голос поддельным и по каким признакам. Если корпоративная памятка всё ещё про роботизированные паузы, её пора переписывать.
Первоисточник