Informatique, téléphonie
17.09.2026 11:32

Partager avec d'autres :

Partager

Google Gemini 3.8 Live permet une commande vocale fluide et l'exécution simultanée de plusieurs tâches.

Photo : Google
Photo : Google

Google lance de nouveaux modèles d'interaction vocale destinés aux développeurs, aux entreprises et aux consommateurs. La version de base, Gemini 3.8 Live, privilégie l'efficacité et la flexibilité. La version plus performante, Gemini 3.8 Live Extended Thinking, est conçue pour résoudre des tâches complexes en plusieurs étapes.

Gemini 3.8 Live permet un traitement quasi instantané des entrées visuelles, avec une adaptation et un passage fluides entre 97 langues prises en charge au cours d'une conversation. L'une des caractéristiques uniques de cette solution est sa capacité à exécuter des outils et à appeler des interfaces de programmation (API) en arrière-plan sans interrompre la conversation vocale. L'utilisateur peut ainsi continuer à communiquer pendant que le système effectue des tâches complexes en arrière-plan.

Pour les flux de travail plus complexes, la fonctionnalité de réflexion étendue offre une analyse approfondie, utilisant des réponses vocales naturelles pour valider les requêtes et expliquer la progression en temps réel. Ce modèle se classe premier à l'indice de qualité de la synthèse vocale avec un score de 82,6 et obtient un score de 97,7 (%) au test audio Big Bench. L'intégration est déjà disponible dans les services Google Workspace, notamment Docs Live, Gmail Live, Keep Live et Search Live.

Pour garantir la sécurité et prévenir toute désinformation, un filigrane SynthID est intégré de manière transparente à tous les fichiers audio générés. Bien que cette nouvelle fonctionnalité promette un contrôle vocal fluide et une grande précision, il convient de faire preuve de prudence lors de son utilisation en production et de tester minutieusement son fonctionnement.


Vous souhaitez en savoir plus sur ce sujet ?
Google


Que lisent les autres ?