ByteDance revela SeedRealtime, un LLM audiovisual full-duplex
El equipo Seed de ByteDance presentó SeedRealtime, un modelo de lenguaje grande audiovisual nativo capaz de conversación full-duplex en tiempo real. El modelo fusiona audio, video y texto en una arquitectura unificada única, permitiendo escucha y habla simultáneas con cronometraje de conversación natural. Actualmente implementado en el asistente Doubao de ByteDance, SeedRealtime representa un cambio de arquitecturas en cascada que encadenan componentes separados, moviendo la percepción y la toma de decisiones al procesamiento paralelo dentro de un único modelo de extremo a extremo.