IA
Google lance Gemini 3.5 Transcribe, modèle vocal à 2,6 % d’erreur
Google a lancé Gemini 3.5 Transcribe, un modèle spécialisé en reconnaissance vocale atteignant un taux d’erreur de 2,6 % sur 85 langues et dialectes, disponible via ses API cloud pour les développeurs.

Google a officiellement présenté Gemini 3.5 Transcribe, son nouveau modèle dédié à la transcription vocale. Ce système marque une avancée significative dans la conversion précise de la parole en texte.
Le modèle enregistre un taux d’erreur de 2,6 % sur un ensemble de 85 langues et dialectes. Il est conçu pour interpréter avec fiabilité des accents locaux, s’adapter aux environnements sonores bruyants et produire des retranscriptions instantanées de réunions ou d’appels téléphoniques.
Capacité à distinguer les voix et filtrer le bruit
Selon un article publié sur MarkTechPost, cette évolution vise à simplifier la communication internationale et à intégrer la traduction en temps réel dans les applications intelligentes et les assistants numériques. La structure neuronale du modèle lui permet d’identifier plusieurs locuteurs présents simultanément dans une même pièce et d’isoler efficacement les interférences sonores.
Google confirme que Gemini 3.5 Transcribe est accessible aux développeurs via ses interfaces de programmation applicative (API) cloud. Il est destiné à renforcer des outils dans les domaines du service client, de l’éducation numérique, ainsi que de l’automatisation des procédures documentaires médicales et juridiques.
Intégration dans les services quotidiens
La société américaine prévoit d’intégrer ce modèle dans ses services grand public. L’objectif est d’éliminer les barrières linguistiques et de fournir des outils productifs permettant aux organisations d’atteindre leurs publics mondiaux avec fluidité et professionnalisme.
Dernières actualités

Mohamed Salah adresse un message aux supporters de Trabzonspor

Mbappé relance sa course à la Ballon d’Or avec trois buts au Bernabéu

Quand votre ami est aussi thérapeute


