Trend Radar

FINTECH · DAILY · 23 СЕНТЯБРЯ

Google DeepMind представила Gemini 3

Google DeepMind представила Gemini 3.8 Live, способную рассуждать и использовать инструменты без остановки голосового диалога

Голосовые агенты развиваются одновременно в облачном и локальном контурах. Конкурентное преимущество формируют непрерывный диалог, малая задержка и готовая корпоративная интеграция

📌 Competitors

Gemini говорит и думает

Gemini 3.8 Live совмещает голосовой диалог с рассуждением и вызовом инструментов без заметного прерывания разговора

Непрерывное выполнение инструментов во время речи задаёт новый базовый уровень для корпоративных голосовых агентов

startuphub.ai

Платформа Voice.ai

Voice.ai предлагает корпоративную платформу с голосовыми агентами, синтезом речи, каталогом голосов, API и SDK

Готовый набор голосовой инфраструктуры усиливает давление на команды, которые продают отдельные компоненты вместо целостного агентного продукта

voice.ai

📌 Voice Ai

Локальный Voxtral TTS

Voxtral TTS с размером около 3 ГБ и задержкой первого аудио около 70 мс позволяет запускать голосовых агентов полностью на периферийных устройствах

Локальное исполнение снижает зависимость от сети и расширяет применение агентов в приватных и критичных корпоративных средах

dev.to

📌 Regulation

Раскрытие синтетических голосов

Калифорния приняла требование раскрывать использование синтетических исполнителей на фоне выхода новых голосовых моделей Apple, Google, xAI и Alibaba

Прозрачное обозначение синтетической речи становится продуктовым требованием для голосовых агентов, работающих с клиентами и контентом

voiceaispace.com

ПоделитьсяTelegramX
Ещё из Fintech