Alibaba apresenta a série Qwen-Audio-3.1 e reduz os preços de todos os produtos
Em 23 de setembro de 2026, a equipe da Alibaba, Qwen, lançou a série Qwen-Audio-3.1, um conjunto abrangente de modelos de áudio que abrange compreensão, geração, interação e criação. O lançamento inclui cinco novos modelos, com redução de preços em todas as categorias: os modelos TTS tiveram uma redução de preço de 70%, os modelos em tempo real diminuíram em 85% e os modelos de reconhecimento de fala (ASR) reduziram-se em 95%.
O modelo Qwen-Audio-3.1-ASR se destaca no reconhecimento de múltiplas línguas e dialetos, alcançando uma média de 4,55% de CER (Taxa de Erro de Confiabilidade) e 10,38% para 16 dialetos. Também oferece transcrições estruturadas e precisão semântica de 82,10%. O modelo Qwen-Audio-3.1-ASR-Next compreende emoções, sons ambientais e pode responder a perguntas baseadas em áudio.
O modelo TTS-Next permite a criação completa de áudio, incluindo voz, efeitos sonoros e ruído de fundo, com suporte para 30 línguas e 16 dialetos. O modelo em tempo real oferece capacidades de conversação avançadas, incluindo reconhecimento de emoções e integração de agentes, aprimorando a interação do usuário com a IA.