Google Dévoile les Modèles Gemini 3.8 Live avec Raisonnement en Temps Réel
Google lance Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking, introduisant des capacités de traitement et de parole simultanées pour éliminer les temps de latence.

Google a annoncé une avancée majeure dans l'intelligence artificielle en temps réel avec le lancement de deux nouveaux modèles : Gemini 3.8 Live et le produit phare Gemini 3.8 Live Extended Thinking, éliminant les temps de silence gênants lors des requêtes vocales complexes.
Penser et Parler Simultanément
La principale avancée ingénierieuse du modèle Extended Thinking est sa capacité à réfléchir et à converser en même temps. Au lieu d'interrompre la conversation, le modèle utilise des indices verbaux naturels tels que « Laissez-moi vérifier cela pour vous », continuant à parler tout en exécutant des tâches complexes en arrière-plan. De plus, le système fournit des mises à jour vocales en temps réel sur la progression, permettant aux utilisateurs d'ajuster les instructions en cours de route.
Ces fonctionnalités s'intègrent profondément dans les services Google Workspace. Les utilisateurs peuvent exploiter Gmail Live pour des recherches vocales intelligentes, Docs Live pour rédiger des documents, et Keep Live pour des listes de courses vocales. Le système peut coordonner des réservations de restaurant, résoudre des problèmes techniques et générer du code informatique de manière fluide.
Support Linguistique Global et Performance
Aux côtés du modèle de raisonnement étendu, Google a introduit le modèle de base Gemini 3.8 Live, optimisé pour la vitesse et l'efficacité économique. Il traite les entrées visuelles de la caméra en temps réel et gère la transition automatique entre 97 langues au milieu d'une conversation. Dans les classements mondiaux, le modèle Extended Thinking s'est classé premier dans l'indice de qualité vocale d'Artificial Analysis avec un score record de 82.6.
Pour des raisons de sécurité, Google a intégré un filigrane numérique transparent SynthID dans les signaux audio générés afin de garantir la transparence. Les modèles sont déployés dès aujourd'hui dans les interfaces de développement Google AI Studio, Gemini Enterprise et Search Live.





