Голос клонируют за 10 секунд: как ИИ-мошенники обкрадывают украинцев
июля 2026 года в украинском инфополе зафиксирован аудиодипфейк с голосом мэра Харькова Игоря Терехова, как сообщает znaj.ua со ссылкой на Центр противодействия дезинформации при СНБО.
Савелий Попов·обновлено 03 августа 2026 г.

Голосовая модель воспроизвела тембр и интонации чиновника на уровне, достаточном для убедительной имитации. Кейс показателен для индустрии TTS как иллюстрация текущей планки zero-shot клонирования — технологии, перешедшей из исследовательских демо в инструмент с порогом входа около нуля.
Спецификация метода
Современные пайплайны клонирования делятся на два класса. Первый — fine-tuning: модель дообучается на конкретном тембре, требует десятки минут чистой речи, даёт максимальное качество синтеза. Второй — zero-shot: предобученная на миллионах дикторов архитектура извлекает эмбеддинг тембра из короткого образца и генерирует речь без обновления весов. Именно второй метод стал доступен массовому пользователю.
Контрольные точки по длине входного аудио, зафиксированные в материале znaj.ua:
- OpenAI Voice Engine, 2024: 15 секунд.
- ElevenLabs: 10–30 секунд записи без шума и музыки.
- Отдельные инструменты 2026 года: 3 секунды чёткой речи.
Входные данные — голосовое сообщение в мессенджере, сторис, фрагмент видео в TikTok. Специального оборудования и технических знаний для запуска инференса не требуется.
Где это уже применяется
Molfar Intelligence Institute проанализировал серию аудиодипфейков из TikTok и Facebook: сгенерированные голоса «депутатов», «военных», «раввина» под фейковые нарративы о мобилизации и миграции в ТЦК. Во время зимней Олимпиады 2026 года под логотипами Euronews, CBC, Reuters распространялись сфабрикованные сюжеты об «изоляции» украинских спортсменов. Все персонажи анонимны и не верифицируются за секунды просмотра.
Когнитивная уязвимость зафиксирована: в стрессовой ситуации мозг не проводит спектральный анализ тембра. Голос родственника — главный фактор доверия в телефонном канале. Целевая аудитория мошенников — пожилые люди, не ожидающие подмены «родного» голоса.
Регуляторика и практический контроль
EU AI Act с августа 2026 года обязывает маркировать ИИ-контент. Ограничение действует на легальные платформы, не на закрытые пайплайны и серые сервисы. Юридическая маркировка не закрывает социальную инженерию по голосовому каналу.
Что работает на практике:
- Кодовое слово или контрольный вопрос — единственный надёжный способ верификации до передачи чувствительных действий.
- Публикация аудио в открытых каналах — это потенциальный датасет для клонирования; стоит учитывать при выборе формата контента.
- При работе с zero-shot пайплайнами закладывать, что выход модели не отличим от живого диктора для неподготовленного слушателя.
Длина записи больше не барьер. Порог сместился из плоскости «можно ли клонировать» в плоскость «как верифицировать источник до передачи денег или действий».