LIVE
Новость

Голосовые дипфейки стали новым инструментом кибератак на корпоративный сектор

По данным iGuides, эксперты по кибербезопасности отмечают массовое использование клонированных нейросетями голосов топ-менеджеров в схемах социальной инженерии против сотрудников компаний.

Савелий Попов·обновлено 19 сентября 2026 г.

Голосовые дипфейки стали новым инструментом кибератак на корпоративный сектор

UserGate зафиксировал рост целевых атак на корпоративный сегмент с применением голосовых дипфейков. По данным iGuides, эксперты по кибербезопасности отмечают массовое использование клонированных нейросетями голосов топ-менеджеров в схемах социальной инженерии против сотрудников компаний. Для индустрии синтеза речи это индикатор перехода моделей клонирования из лабораторной стадии в операционный инструментарий атакующих.

Вектор и механика

Атака строится вокруг пайплайна TTS-клонирования в реальном времени. Образец голоса цели извлекается из открытых источников — публичных выступлений, подкастов, корпоративных видео, голосовых сообщений в мессенджерах — и подаётся на вход модели с zero-shot поддержкой. На выходе синтезатор выдаёт речь с сохранением просодии и манеры говорящего. По данным iGuides, аудиодипфейки применяются в мессенджерах и корпоративной телефонии. Цель — инициировать перевод средств или получить учётные данные.

Технический порог снизился критически. Современные модели обеспечивают убедительное клонирование по 10–30 секундам чистого аудио цели без дообучения. Инференс укладывается в задержку живого разговора при работе на одном GPU потребительского класса. Это убирает необходимость в специализированной инфраструктуре у атакующего.

Контур защиты

Прямая верификация по альтернативному каналу — единственный устойчивый контроль. Голос как аутентификатор в корпоративных процессах обнулён.

Минимальный регламент для финансовых и административных запросов: обратный звонок на номер из CRM, подтверждение операции через аппаратный второй фактор, сверка реквизитов по ранее подтверждённому каналу. Любое изменение платёжных инструкций — только через видеозвонок с верификацией лица.

Сценарий с подрядчиком требует аналогичной дисциплины. Если входящий голосовой запрос ссылается на срочный пересмотр тарифов и рост цен из-за подорожания грузоперевозок, это классический повод оказать давление на оператора и провести платёж в обход стандартной процедуры сверки. То же касается звонков «от логистов», «от экспедиторов», «от смежного юрлица» с просьбой срочно подтвердить новые реквизиты.

Контекст для индустрии TTS

Масштаб инцидентов коррелирует с распространением открытых моделей клонирования и падением стоимости инференса. Качественная имитация конкретного голоса больше не требует ни размеченного датасета, ни GPU-кластера.

Для разработчиков голосовых моделей это формирует запрос на встраивание нестираемых водяных знаков в синтезированный аудиопоток и на развитие детекторов синтеза с публикацией весов. Для служб безопасности — пересмотр регламентов эскалации любых голосовых запросов на финансовые действия и аудит каналов публикации голоса первых лиц.