lupAI
Novos Desenvolvimentos

Google lança modelos avançados de texto para fala para criação de voz personalizada

Gemini + GoogleFonte: Google DeepMind Blog, MarkTechPost23/09/2026, 17:10
A Google introduziu dois novos modelos de texto para fala, Gemini 3.8 Flash TTS e Gemini 3.8 Flash-Lite TTS, projetados para oferecer aos criadores e desenvolvedores capacidades altamente expressivas e personalizáveis de geração de voz. Estes modelos permitem a criação de vozes realistas com controle preciso sobre sotaques, tom emocional e entrega de diálogo, suportando mais de 100 idiomas. Os modelos fazem parte da crescente família de áudio Gemini da Google, seguindo lançamentos anteriores como 3.5 Live Translate e 3.5 Transcribe. O Gemini 3.8 Flash TTS alcançou a 1ª posição no Voice Design Benchmark da Hume AI e lidera na modelagem de sotaques, enquanto o Flash-Lite TTS ocupa a 2ª posição no Índice de Qualidade Geral. Ambos os modelos estão disponíveis hoje e estão integrados em plataformas como Google AI Studio, Gemini Notebook e Google Vids. A Google enfatiza medidas de segurança, incluindo verificação de consentimento para replicação de voz e marcas d'água SynthID para prevenir a desinformação. As novas ferramentas estão a ser adotadas por parceiros como Figma, HeyGen e Linguana para melhorar a dublagem global e a produção de mídia localizada. Os desenvolvedores agora podem construir e implantar experiências de fala de alto desempenho utilizando a API Gemini, com suporte para conteúdo multilingue e agentes de voz interativos.
Google lança modelos avançados de texto para fala para criação de voz personalizada — lupAI