Google lance gratuitement Rambler, l'une des fonctionnalités les plus cool du Pixel
Google dévoile Gemini 3.5 Transcribe, le modèle derrière la fonction Rambler. Il permet de filtrer les bruits de fond et les hésitations pour une transcription claire et précise.

Il y a deux semaines, Google a dévoilé la nouvelle série d'appareils Pixel 11, et parmi les diverses innovations, elle a révélé une fonctionnalité appelée Rambler. Maintenant, l'entreprise lance officiellement le modèle qui sous-tend cette fonctionnalité, afin que d'autres appareils puissent en profiter. Rencontrez Gemini 3.5 Transcribe, le nouveau modèle de transcription de Google qui apporte une véritable avancée.
Sa capacité la plus centrale est de filtrer tous nos bruits de fond humains. Même si vous enregistrez un message qui consiste principalement en des « euh » et des pauses, le résultat final inclura uniquement les mots pertinents, débarrassés des mots de remplissage inutiles. Cette capacité est exactement ce qui la place au cœur de la fonctionnalité Rambler du Pixel 11. Le nom de la fonctionnalité est dérivé du verbe anglais signifiant « divaguer », et elle est destinée à éviter exactement cela : couper tous les mots inutiles autour de votre message principal.
La fonctionnalité, présentée pour la première fois lors de la Google I/O en mai, est arrivée sur les appareils phares de l'entreprise via le clavier Gboard, mais elle n'est pas encore disponible pour d'autres fabricants ou les anciens modèles Pixel. En termes de performances, Google rapporte que le nouveau modèle est nettement plus rapide et plus précis que son précédent moteur, Chirp 3. La vitesse de transcription a enregistré un bond de 70 % par rapport à la génération précédente, et le taux d'erreur s'établit à 5,5 % — une amélioration par rapport aux 7,32 % de Chirp 3.
En plus des performances, le modèle prend en charge plus de 85 langues dès le lancement, y compris l'hébreu. Il comprend une fenêtre dédiée où vous pouvez saisir des mots spécifiques que le modèle pourrait manquer, ce qui lui permettra d'apprendre de nouveaux termes et vous évitera des corrections répétées. Le modèle démontre une capacité impressionnante à basculer entre les langues en temps réel et sait identifier les références aux chiffres et aux dates pour les convertir dans un format numérique logique.
Une autre fonctionnalité est la transcription intelligente. Si vous lui dictez : « Je veux un grand expresso, euh, en fait, je préfère un americano, non, non, je veux un latte avec un peu de lait » — il vous proposera à la fois la transcription complète et une version « Je veux un latte avec un peu de lait ».
À l'heure actuelle, le modèle atteint les utilisateurs via une application macOS et pour les utilisateurs de Pixel 11 via la fonctionnalité Rambler. De plus, le modèle est disponible pour les développeurs via l'API et l'environnement AI Studio.
Malgré cette nouveauté, on ne peut ignorer le retard peu élégant de Google dans ses lancements. Lors de sa dernière conférence des développeurs, l'entreprise a dévoilé la famille Gemini 3.5 et a promis l'arrivée de Gemini 3.5 Pro un mois plus tard. En pratique, cette date limite est passée il y a deux mois, et le dernier modèle Pro proposé est toujours Gemini 3.1 Pro, lancé il y a six mois — une éternité dans le cycle de vie actuel des modèles. Google continue de lancer des modèles Flash rapides, mais ils ne peuvent rivaliser avec les modèles avancés d'OpenAI et d'Anthropic. De plus, des acteurs chinois comme Z.ai et Alibaba lancent d'excellents modèles avec des poids ouverts qui ont déjà réussi à dépasser Google.





