LIVE
Новость

Голос клонируют за 10 секунд: как ИИ-мошенники обкрадывают украинцев

июля 2026 года в украинском инфополе зафиксирован аудиодипфейк с голосом мэра Харькова Игоря Терехова, как сообщает znaj.ua со ссылкой на Центр противодействия дезинформации при СНБО.

Савелий Попов·обновлено 03 августа 2026 г.

Голос клонируют за 10 секунд: как ИИ-мошенники обкрадывают украинцев

Голосовая модель воспроизвела тембр и интонации чиновника на уровне, достаточном для убедительной имитации. Кейс показателен для индустрии TTS как иллюстрация текущей планки zero-shot клонирования — технологии, перешедшей из исследовательских демо в инструмент с порогом входа около нуля.

Спецификация метода

Современные пайплайны клонирования делятся на два класса. Первый — fine-tuning: модель дообучается на конкретном тембре, требует десятки минут чистой речи, даёт максимальное качество синтеза. Второй — zero-shot: предобученная на миллионах дикторов архитектура извлекает эмбеддинг тембра из короткого образца и генерирует речь без обновления весов. Именно второй метод стал доступен массовому пользователю.

Контрольные точки по длине входного аудио, зафиксированные в материале znaj.ua:

  • OpenAI Voice Engine, 2024: 15 секунд.
  • ElevenLabs: 10–30 секунд записи без шума и музыки.
  • Отдельные инструменты 2026 года: 3 секунды чёткой речи.

Входные данные — голосовое сообщение в мессенджере, сторис, фрагмент видео в TikTok. Специального оборудования и технических знаний для запуска инференса не требуется.

Где это уже применяется

Molfar Intelligence Institute проанализировал серию аудиодипфейков из TikTok и Facebook: сгенерированные голоса «депутатов», «военных», «раввина» под фейковые нарративы о мобилизации и миграции в ТЦК. Во время зимней Олимпиады 2026 года под логотипами Euronews, CBC, Reuters распространялись сфабрикованные сюжеты об «изоляции» украинских спортсменов. Все персонажи анонимны и не верифицируются за секунды просмотра.

Когнитивная уязвимость зафиксирована: в стрессовой ситуации мозг не проводит спектральный анализ тембра. Голос родственника — главный фактор доверия в телефонном канале. Целевая аудитория мошенников — пожилые люди, не ожидающие подмены «родного» голоса.

Регуляторика и практический контроль

EU AI Act с августа 2026 года обязывает маркировать ИИ-контент. Ограничение действует на легальные платформы, не на закрытые пайплайны и серые сервисы. Юридическая маркировка не закрывает социальную инженерию по голосовому каналу.

Что работает на практике:

  • Кодовое слово или контрольный вопрос — единственный надёжный способ верификации до передачи чувствительных действий.
  • Публикация аудио в открытых каналах — это потенциальный датасет для клонирования; стоит учитывать при выборе формата контента.
  • При работе с zero-shot пайплайнами закладывать, что выход модели не отличим от живого диктора для неподготовленного слушателя.

Длина записи больше не барьер. Порог сместился из плоскости «можно ли клонировать» в плоскость «как верифицировать источник до передачи денег или действий».