Google DeepMind представила Gemini 3.8 Live, способную рассуждать и использовать инструменты без остановки голосового диалога
Голосовые агенты развиваются одновременно в облачном и локальном контурах. Конкурентное преимущество формируют непрерывный диалог, малая задержка и готовая корпоративная интеграция
📌 Competitors
Gemini говорит и думает
Gemini 3.8 Live совмещает голосовой диалог с рассуждением и вызовом инструментов без заметного прерывания разговора
Непрерывное выполнение инструментов во время речи задаёт новый базовый уровень для корпоративных голосовых агентов
Платформа Voice.ai
Voice.ai предлагает корпоративную платформу с голосовыми агентами, синтезом речи, каталогом голосов, API и SDK
Готовый набор голосовой инфраструктуры усиливает давление на команды, которые продают отдельные компоненты вместо целостного агентного продукта
📌 Voice Ai
Локальный Voxtral TTS
Voxtral TTS с размером около 3 ГБ и задержкой первого аудио около 70 мс позволяет запускать голосовых агентов полностью на периферийных устройствах
Локальное исполнение снижает зависимость от сети и расширяет применение агентов в приватных и критичных корпоративных средах
📌 Regulation
Раскрытие синтетических голосов
Калифорния приняла требование раскрывать использование синтетических исполнителей на фоне выхода новых голосовых моделей Apple, Google, xAI и Alibaba
Прозрачное обозначение синтетической речи становится продуктовым требованием для голосовых агентов, работающих с клиентами и контентом