Google a présenté le 15 septembre 2026 Gemini 3.8 Live et sa variante Extended Thinking, deux modèles vocaux conçus pour des conversations en temps réel, selon le blog officiel de Google. Les deux modèles combinent traitement visuel quasi instantané, détection automatique parmi 97 langues et exécution d’outils en arrière-plan sans interrompre la conversation.

Deux variantes pour deux besoins

Gemini 3.8 Live cible le volume et le coût, avec une priorité donnée à la fluidité du dialogue et à l’ancrage visuel — la capacité à raisonner sur ce que l’utilisateur montre à la caméra pendant qu’il parle. Gemini 3.8 Live Extended Thinking vise les tâches qui demandent plusieurs étapes de raisonnement, tout en conservant une conversation naturelle : le modèle peut réfléchir et parler simultanément, sans les silences habituellement associés au raisonnement plus poussé.

Des scores en tête des classements vocaux

Google avance plusieurs résultats de benchmarks pour la variante Extended Thinking : un score de 82,6 sur l’indice Speech to Speech Quality de la plateforme indépendante Artificial Analysis, qui le placerait en première position, ainsi que 68,6 % de réussite sur le benchmark agentique τ-Voice et 97,7 % sur Big Bench Audio, un test de raisonnement audio.

Disponibilité : développeurs d’abord, grand public ensuite

Les deux modèles sont accessibles dès maintenant aux développeurs via l’API Gemini et Google AI Studio. Les entreprises y accèdent en préversion privée dans Gemini Enterprise. Le grand public retrouvera ces capacités intégrées à Search Live, à Gemini Live et à plusieurs applications Google Workspace, dont Docs, Gmail et Keep. Comme pour les précédents modèles audio de Google, chaque contenu sonore généré porte le filigrane SynthID, destiné à signaler son origine artificielle.

Une confirmation venue de plusieurs sources

L’annonce a été relayée le jour même par 9to5Google et par le site spécialisé TestingCatalog, qui suivait déjà des signes de déploiement progressif avant la publication officielle. Cette convergence entre le blog de Google et la couverture indépendante confirme qu’il s’agit d’un lancement effectif, et non d’un simple test interne.

Quelle est la différence entre Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking ?

Gemini 3.8 Live privilégie la fluidité et le coût pour un usage à grande échelle, tandis que Extended Thinking ajoute un raisonnement multi-étapes plus poussé tout en gardant une conversation naturelle.

Gemini 3.8 Live est-il disponible pour le grand public ?

Les développeurs y accèdent dès maintenant via l’API Gemini et Google AI Studio. Le grand public le retrouvera dans Search Live, Gemini Live et plusieurs applications Google Workspace comme Gmail ou Docs.

Comment Google signale-t-il que l’audio est généré par IA ?

Chaque contenu audio produit par Gemini 3.8 Live intègre le filigrane SynthID, qui permet d’identifier son origine artificielle.

Share.
Exit mobile version