O Google lançou dois novos modelos de texto-para-fala, Gemini 3.8 Flash TTS e Gemini 3.8 Flash-Lite TTS, ampliando a família Gemini Audio para oferecer capacidades dinâmicas de geração de voz para criadores, desenvolvedores e empresas.

  • O Gemini 3.8 Flash TTS permite direção criativa profunda, permitindo que os usuários criem novas vozes do zero usando prompts em linguagem natural e controlem as indicações de desempenho linha por linha.
  • O Gemini 3.8 Flash-Lite TTS é otimizado para escala de alto volume e custo eficiente, suportando dublagem e agentes de voz expressivos com controle fino sobre tom e ritmo.
  • Os modelos suportam mais de 100 idiomas e dialetos, incluindo variedades regionais como espanhol mexicano e inglês escocês, e oferecem uma biblioteca com mais de 2.000 vozes prontas para produção.
  • As funcionalidades de replicação de voz permitem que os usuários recriem perfis vocais a partir de uma amostra de 30 segundos, respaldadas por verificação de consentimento, marca d'água SynthID e credenciais C2PA.
  • Ambos os modelos conquistaram as primeiras posições nos benchmarks da Hume AI, com o Gemini 3.8 Flash TTS liderando o Índice Geral de Qualidade e o Benchmark de Design de Voz.

Essas ferramentas já estão disponíveis no Google AI Studio e na API Gemini para desenvolvedores, enquanto o acesso empresarial chegará em breve via Gemini Enterprise.