Андрей Головин, ведущий аналитик «СёрчИнформ»
Мошенникам больше не нужны актерские способности и дорогое оборудование, чтобы говорить чужим голосом. Генеративные модели научились воспроизводить тембр, паузы, манеру речи за минуты из обрывков публичных записей. Но главное изменение – технология стала дешевой и доступной человеку без профессиональных навыков. Приложения работают на обычном смартфоне, а звонок строится на заранее собранных сведениях о семье и работе жертвы. Ниже в статье разберем, почему голосовые дипфейки стали серьезной угрозой именно сейчас, по каким признакам распознать атаку и что делать, если деньги уже ушли.
Угроза оказалась массовой…
Голосовые дипфейки существовали и раньше. Но долгое время оставались дорогим и технически сложным инструментом. Для качественной записи требовалось мощное оборудование, специалисты по обработке звука и пр.
Сейчас порог входа снизился. Атаки с использованием дипфейков заметно участились. Об этом говорят и растущее число публичных кейсов, и отраслевые исследования. По их данным, с 2024 по 2026 год количество выявленных дипфейк-инцидентов в России выросло более чем в 25 раз.
Главная причина — удешевление технологии. Для замены голоса, в том числе в реальном времени, больше не нужны мощное «железо» и специальные навыки. Появились инструменты за символическую плату, которые работают по принципу «нажми кнопку — получи результат», причем результат получается вполне приличного качества. А инструкции по обучению моделей лежат в открытом доступе.
Для клонирования голоса злоумышленнику достаточно около 30 секунд чистой речи жертвы. Нейросеть воспроизводит не только тембр, но и манеру говорить: характерные паузы, слова-паразиты, скорость речи и интонации.
Кейс
Управляющий гонконгским филиалом японской компаниисанкционировал переводы на общую сумму 35 млн долларов после звонка человека, чей голос совпадал с голосом директора компании. Звонивший сослался на сделку по поглощению и сообщил, что для координации платежей привлечен юрист. Одновременно пришли подтверждающие письма от «директора» и «юриста». По данным следователей из ОАЭ, в схеме участвовали не менее 17 человек, а средства прошли через счета в разных странах. Позднее ОАЭ обратились к властям США за помощью в отслеживании части денег, поступивших в американские банки. Дело стало известно благодаря судебным материалам из ОАЭ.
А голос настоящий?
Как правило, атаке предшествует сбор информации о жертве из открытых источников. Голос руководителя или родственника берется из публичных выступлений, сторис в социальных сетях, записей рабочих видеоконференций или коротких голосовых сообщений в мессенджерах, которые кто-то переслал третьим лицам.
Затем жертва получает звонок или голосовое сообщение с требованием срочно провести платеж, перевести деньги или передать данные. Чтобы усилить давление, мошенники ссылаются на чрезвычайную ситуацию, которая требует немедленного решения.
При этом качество современных дипфейков таково, что отличить синтез от оригинала на слух становится все сложнее. Модели воспроизводят хрипотцу и темп речи, а также умеют генерировать дрожь в голосе, учащенное дыхание, слезы и фоновые шумы. Например, если жертва знает, что родственник сейчас в торговом центре, звонок будет сопровождаться гулом толпы. Контекст совпадает с ожиданиями — и критическое мышление отключается.
Кейс
Жительнице Дувра (Флорида) Шэрон Брайтвелл позвонила «дочь» — в слезах сообщила, что попала в аварию, потеряла нерожденного ребенка и ей грозят обвинения. Затем «адвокат» попросил деньги на юридическую защиту. Брайтвелл передала курьеру 15 000 долларов наличными. Лишь поговорив с настоящей дочерью, она поняла, что голос в трубке был ИИ-клоном.
Как распознать атаку на компанию
Успех таких атак объясняется не столько совершенством технологий, сколько грамотным применением социальной инженерии. Частая ставка — авторитет руководителя: мошенники искусственно создают ощущение срочности и убеждают сотрудника действовать немедленно, не советуясь с коллегами.
Поводом для проверки должно стать любое нетипичное финансовое поручение, полученное через мессенджер, видеозвонок или с личного номера телефона. Особую настороженность должны вызывать ситуации, когда собеседник:
Стоит обращать внимание и на косвенные признаки: недавно созданный аккаунт, нетипичную манеру общения, ошибки в написании имени контакта, технические артефакты во время видеосвязи. Подробнее, как создаются дипфейки и как их распознать – читайте в нашем блоге.
Кейс
Capillary Technologies, SaaS-разработчик программ лояльности со штаб-квартирой в Бангалоре, сообщила в раскрытии для биржи, что ее недавно приобретенная зарубежная дочерняя компания второго уровня стала жертвой банковского мошенничества с использованием киберсредств. Злоумышленники выдавали себя за ключевых руководителей компании, применяя клонирование голоса, поддельные подписи и социальную инженерию, и убедили сотрудников санкционировать переводы примерно на 3 млн евро на сторонние счета. Инцидент произошел непосредственно перед выходными. Компания сразу вернула 450 000 евро и добилась заморозки еще ряда счетов. Дочерняя компания была застрахована от киберрисков и преступлений. Комитет по аудиту поручил KPMG провести форензик-проверку транзакций и внутреннего финансового контроля.
Правила защиты
Какого-то универсального способа защиты от дипфейков нет. Но есть базовые правила. Они несложные и работают только при последовательном соблюдении.
Вместо вывода
Голос перестал быть надежным подтверждением личности. В корпоративной среде это означает одно: любое финансовое распоряжение, полученное по голосовому каналу, требует подтверждения через второй, независимый канал — точно так же, как пароль давно перестал быть единственным фактором входа в систему. Такая проверка занимает минуту и не требует никаких вложений, а закрепить ее стоит на уровне внутреннего регламента, чтобы сотруднику не приходилось принимать это решение под давлением.
© СёрчИнформ (SearchInform), 2026
© Издание 12NEWS (ИП Маринин А.Л.), 2026