Google lança modelo de tradução de voz em tempo real para mais de 70 idiomas
A Google anunciou o Gemini 3.5 Live Translate, um novo modelo de inteligência artificial especializado na tradução automática de fala em tempo real. O sistema consegue detectar e processar mais de 70 idiomas, gerando áudio traduzido que mantém as características vocais do falante original, incluindo entonação e ritmo.
O modelo funciona de forma contínua durante as conversas, evitando as pausas características dos sistemas tradicionais que aguardam o fim de cada frase. A tecnologia está a ser integrada gradualmente em produtos Google como o Google Meet e a aplicação Google Translate, com suporte inicial em modo privado para clientes empresariais.
Parceiros como a Grab e plataformas de desenvolvimento como LiveKit e Pipecat já estão a testar o novo modelo. O sistema inclui ainda uma marca de água digital (SynthID) que identifica o conteúdo gerado por IA, e oferece recursos como o modo de escuta para utilizadores Android, que permite ouvir as traduções diretamente pelo auscultador do telemóvel.