./новости · 29 июля 2026 г.
новость
Советы «как распознать дипфейк» не работают: за голосом сидит живой человек с конвертером
источник: reddit.com·
машинная выжимка · сверена с источником
Голосовой вишинг - это не бот с клонированным голосом, а живой оператор, который говорит через конвертер голоса в реальном времени. Так 29 июля схему описал инженер, который строит симуляторы таких атак. Он выложил бесплатное демо: без регистрации, 60 секунд на попытку, 5 фиксированных личностей, конвертацию тянут 8 облачных GPU, поэтому будет очередь. Рядом второе демо - подмена лица на видео.
Почему это важно: Инструкции по распознаванию учат ловить артефакты синтеза: плоская интонация, ровное дыхание, странные паузы, задержка перед ответом. Все эти признаки родом из text-to-speech, где текст произносит машина. При конверсии голоса говорит человек: интонация, дыхание, паузы и реакция на перебивание остаются живыми, меняется только тембр. Чек-лист ловит вчерашний способ атаки. Свои личности в демо автор зафиксировал специально и вшил в звук артефакты, чтобы запись нельзя было унести и применить. Сколько людей проваливают тест на самом деле, он не меряет, а симуляторы вишинга продаёт - про конфликт интересов сказал сам.
Что дальше: Взять 60-секундный сэмпл из демо и дать послушать своей команде: посчитать, сколько человек назовут голос поддельным и по каким признакам. Если корпоративная памятка всё ещё про роботизированные паузы, её пора переписывать.
первоисточник