lupAI
Novos Desenvolvimentos

NVIDIA apresenta o nemotron3diarization, um modelo de IA gratuito para separação de voz multi-falantes em tempo real

NVIDIAFonte: AIBase28/09/2026, 10:53
Em 27 de setembro de 2026, a NVIDIA anunciou o lançamento do Nemotron3Diarization, um modelo de IA gratuito com aproximadamente 100 milhões de parâmetros. Este modelo é especializado em agrupamento de segmentação de fala, permitindo a identificação precisa de falantes em conversas. Suporta o processamento de áudio em tempo real e gravado para até oito falantes simultâneos. O modelo alcançou uma taxa de erro de 14,72% (DER) no benchmark VoiceArena, superando o sistema em segundo lugar em 4,58 pontos percentuais. O Nemotron3Diarization da NVIDIA também melhorou em relação ao seu antecessor, o Streaming Sortformer, com uma redução média de taxa de erro de 41% em oito cenários de teste usando um buffer de áudio de 1,04 segundos. O modelo oferece quatro configurações dinâmicas de buffer de áudio, variando de 0,32 segundos a 30,4 segundos, para equilibrar latência e precisão. Pode ser usado com sistemas de reconhecimento de fala como o Parakeet para gerar texto com etiquetas de falante anônimas, como 'speaker_2'. O lançamento deste modelo leve e de alta precisão reduz as barreiras técnicas para a análise complexa de fala. Fornece suporte de baixo custo para a gravação de reuniões em tempo real, atendimento ao cliente inteligente e interações de voz multi-falantes, acelerando a implantação da identificação de multi-falantes em dispositivos de borda e cenários comerciais em tempo real.
NVIDIA apresenta o nemotron3diarization, um modelo de IA gratuito para separação de voz multi-falantes em tempo real — lupAI