lupAI
Novos Desenvolvimentos

Huawei apresenta o Spark-Audio-1.0-Preview, um modelo de base de voz desenvolvido internamente

iFLYTEKFonte: ITHome16/09/2026, 07:09
Em 16 de setembro de 2026, a iFLYTEK anunciou o lançamento do Spark-Audio-1.0-Preview, um modelo de base de voz treinado inteiramente em poder de computação local. Este modelo aborda problemas persistentes com o processamento de áudio tradicional, que dependiam de sistemas em cascata que convertiam a fala em texto antes da análise, levando à perda de informações e a fluxos de trabalho fragmentados. O Spark-Audio-1.0-Preview processa o áudio diretamente, compreendendo a fala, sons ambientais e emoções, sem etapas intermediárias. Ele possui um codificador de áudio denso de 0,65B e um modelo de linguagem MoE de 30B-A3B, treinados em 13 milhões de horas de dados de áudio e texto. O modelo suporta 99 idiomas e 202 dialetos, superando concorrentes como o Qwen3.5-omni-flash em tarefas multilinguísticas e alcançando resultados de ponta no conjunto de dados Fleurs. A iFLYTEK afirma que o modelo funciona bem em condições de ruído e baixo volume, e agora está disponível para testes públicos, com acesso à API planejado para a plataforma aberta.
Huawei apresenta o Spark-Audio-1.0-Preview, um modelo de base de voz desenvolvido internamente — lupAI