Google lanza gemini 3.8 live y gemini 3.8 live extended thinking para interacciones de voz mejoradas
Google ha introducido Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, dos modelos de IA avanzados diseñados para mejorar las interacciones de voz. Estos modelos admiten el razonamiento en tiempo real, capacidades multilingües y la ejecución de tareas en segundo plano, lo que hace que las conversaciones con la IA sean más naturales e intuitivas. Gemini 3.8 Live Extended Thinking destaca en la finalización de tareas con un 68,6% en τ-Voice y un 35,1% en el benchmark τ-Voice-banking de Sierra, mientras que obtiene un 97,7% en Big Bench Audio. Gemini 3.8 Live ocupa el segundo lugar en el Speech Agent Arena y destaca por su rentabilidad.
Los modelos están disponibles a través de la API de Gemini, Google Workspace y la aplicación Gemini, lo que permite a los desarrolladores y a las empresas crear agentes de voz listos para la producción. Socios como Salesforce, Genspark y Lumeris han mostrado interés en los modelos debido a su baja latencia y sus robustas capacidades de llamada de herramientas. El audio generado por estos modelos está marcado con SynthID para garantizar la detectabilidad. Gemini 3.8 Live Extended Thinking se lanza hoy, con opciones de registro para actualizaciones de productos y boletines informativos.