Smallest.ai привлекла $21 млн на создание архитектуры Voice 4.0 для корпоративного сектора
Оба компонента занимают верхние строки Artificial Analysis по скорости, качеству и стоимости, согласно материалу AI Insider.
Савелий Попов·обновлено 15 августа 2026 г.

Smallest.ai закрыла раунд на $21 млн и строит Voice 4.0: архитектура вместо масштаба модели
По данным AI Insider, компания Smallest.ai (Сан-Франциско) сообщила о превышении отметки $21 млн совокупного финансирования после закрытия Series A на $13 млн. Раунд ведёт Seligman Ventures, с участием Sierra Ventures и 3one4 Capital. Деньги пойдут на развёртывание платформы Voice 4.0 в финсе, медицине, контакт-центрах и BPO.
Архитектура Voice 4.0
Ключевой объект — модель Hydra, speech-to-speech с асинхронной обработкой. Вместо классического пайплайна ASR → LLM → TTS → orchestration, где стадии идут последовательно и плодят задержки, Hydra запускает прослушивание, рассуждение, действие и отклик параллельно. Это снижает латентность до миллисекунд и поддерживает естественные прерывания, mid-conversation tool use и потоковый диалог. CEO Sudarshan Kamath позиционирует подход как отказ от масштабирования параметров в пользу пересборки стека.
Pulse STT Pro и Lightning V3.1 — сопутствующие модули платформы. Pulse STT Pro: 38 языков, диаризация, детекция эмоций, code-switching, шумоподавление, встроенная редакция PII и PCI. Lightning V3.1 — TTS. Оба компонента занимают верхние строки Artificial Analysis по скорости, качеству и стоимости, согласно материалу AI Insider.
Что проверять на практике
Корпоративный тренд на голосовых ИИ-агентов уже зафиксирован в цифрах: по данным 2026 AI Voice Agent Report, 87,5% организаций строят или тестируют такие системы. Рынок оценивается в рост до $35 млрд к 2033 году. Зона максимального возврата — контакт-центры: поддержка сокращается до 80%, продуктивность оператора растёт до 10x, заявляет Smallest.ai. Параллельный сдвиг идёт в сторону корпоративных ИИ-агентов нового типа — развёрнутых как платформенный сервис, а не как отдельный эксперимент (подход к запуску таких агентов на инфраструктурном уровне разобран здесь).
Оценка
Hydra — не универсальный ответ, а частное архитектурное решение проблемы последовательного пайплайна. Реальный интерес — не в заявленной «параллельности», а в воспроизводимости метрик латентности на чужом железе и в условиях контакт-центра с шумом и перебиваниями. Pulse STT Pro с 38 языками и встроенной редакцией PII/PCI — рабочий набор для регулируемых вертикалей, но качество редакции и поведение модели на code-switching в продакшене нужно мерить самостоятельно. Цифры экономики (до 80% снижения затрат, 10x продуктивности) — маркетинговые; считать их имеет смысл только на конкретном сценарии и конкретной нагрузке.