Nuevos Desarrollos

NVIDIA Presenta Nemotron 3 Ultra, Modelo de Gran Escala con Optimización Latent MoE

NVIDIA + Nemotron 3 UltraFuente: Sebastian Raschka04/06/2026, 08:56
NVIDIA reveló el Nemotron 3 Ultra, un modelo de lenguaje de código abierto de gran escala que busca equilibrar la eficiencia computacional con el desempeño. El modelo contiene 550 mil millones de parámetros totales con 55 mil millones activos por token, extendiendo la arquitectura híbrida Mamba-Transformer MoE ya presente en la serie Nemotron. La innovación central de Nemotron 3 Ultra es la técnica Latent MoE, que proyecta los expertos en computación a un espacio latente comprimido antes de procesar y reconstruir la salida. Este método mantiene una relación de compresión de 4 veces mientras permite el escalado sustancial de la arquitectura del modelo en general. El modelo combina múltiples mecanismos de eficiencia: Mamba-2, GQA y MTP. Los benchmarks de Artificial Analysis a partir del 4 de junio de 2026 proporcionan un punto de referencia de desempeño para modelos de esta escala. Las especificaciones técnicas completas se encuentran documentadas en el informe técnico oficial de NVIDIA.
NVIDIA Presenta Nemotron 3 Ultra, Modelo de Gran Escala con Optimización Latent MoE — lupAI