Google annonce que ses technologies prennent désormais en charge plus de 300 langues pour plus de 7 milliards de personnes, en introduisant de nouveaux outils pour améliorer la compréhension de la parole, la collecte de données pour les langues sous-représentées et l'accessibilité.

  • Gemini 3.5 Live Translate permet la traduction vocale en temps réel dans 70 langues et plus de 2 000 paires, captant le code-switching et les indices émotionnels.
  • Le Universal Speech Model, entraîné sur 12 millions d'heures d'audio, utilise l'apprentissage par transfert interlinguiste pour soutenir l'objectif de couvrir les 1 000 langues les plus parlées au monde.
  • Les partenariats de données ouvertes incluant WAXAL, Project Vaani et l'Amplify Initiative ont collecté d'importantes données vocales pour les langues d'Afrique subsaharienne et indiennes.
  • TranslateGemma fournit des modèles de traduction ouverts et légers qui fonctionnent efficacement sur l'appareil sans connexion internet.
  • Sign Language-to-Text (SL2T) alimente la dictée de signe vers texte dans Gboard et Live Transcribe pour plus de 50 langues des signes, en commençant par la langue des signes américaine.

Ces innovations visent à combler la fracture numérique en rendant la technologie linguistique accessible hors ligne, en soutenant les dialectes à ressources faibles et en assurant que la nuance culturelle est préservée dans les systèmes d'IA.