Modelo de áudio Qwen-Audio-3.0 lidera competição global em três categorias
A Alibaba anunciou o lançamento da série Qwen-Audio-3.0 em suas plataformas de inteligência artificial. O modelo de áudio desenvolvido internamente pela empresa conquistou o primeiro lugar global em três categorias diferentes na mais recente avaliação da plataforma Artificial Analysis: reconhecimento de fala, síntese de fala e interação em tempo real. A série compreende três soluções especializadas: uma para converter áudio em texto com suporte a contextos complexos e domínios técnicos, outra para gerar fala a partir de texto em múltiplos idiomas com controle de emoção e tom, e uma terceira que permite diálogos bidirecionais contínuos com capacidade de interrupção e integração com outras ferramentas. Desenvolvedores podem acessar as funcionalidades através de chamadas de API ou planos de assinatura.