Google lança gemini 3.8 para interações de voz aprimoradas
A Google introduziu o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking, dois modelos de IA avançados projetados para melhorar as interações de voz. Estes modelos suportam o raciocínio em tempo real, capacidades multilinguísticas e a execução de tarefas em segundo plano, tornando as conversas com a IA mais naturais e intuitivas. O Gemini 3.8 Live Extended Thinking lidera na conclusão de tarefas com 68,6% em τ-Voice e 35,1% no benchmark τ-Voice-banking da Sierra, além de obter 97,7% em Big Bench Audio. O Gemini 3.8 Live ocupa a segunda posição na Speech Agent Arena e é notado por sua eficácia de custo.
Os modelos estão disponíveis através da API Gemini, Google Workspace e do aplicativo Gemini, permitindo que desenvolvedores e empresas criem agentes de voz prontos para produção. Parceiros como Salesforce, Genspark e Lumeris expressaram interesse nos modelos devido à sua baixa latência e robustas capacidades de chamada de ferramentas. O áudio gerado por estes modelos é marcado com SynthID para garantir a detecção. O Gemini 3.8 Live Extended Thinking está disponível hoje, com opções de inscrição para atualizações de produtos e newsletters.