Google lance Gemini 3.8 Live et 3.8 Live Extended Thinking pour les agents vocaux

Cette fiche résume une publication officielle diffusée par Google Blog. Position Zéro en présente les informations essentielles et leur intérêt pour les professionnels du numérique.

L’annonce en bref

Google annonce Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking, deux modèles de dialogue vocal conçus pour le raisonnement en quasi temps réel. Le premier vise les usages à grande échelle et l’efficacité des coûts, tandis que le second cible les tâches complexes et le raisonnement en plusieurs étapes.

Gemini 3.8 Live traite les entrées visuelles en quasi temps réel, prend en charge la détection et le changement entre 97 langues pendant une conversation, et peut exécuter des outils et des appels API en arrière-plan. Les deux modèles sont proposés aux développeurs via Gemini API et Google AI Studio, avec différents déploiements pour les entreprises et les utilisateurs. Les contenus audio générés sont marqués par SynthID.

Le titre reprend les deux modèles annoncés et leur principal usage, les agents vocaux.

L’annonce combine raisonnement vocal en quasi temps réel, entrées visuelles, appels d’outils en arrière-plan et plusieurs canaux de déploiement pour les développeurs, les entreprises et le grand public.

Publicité