AMD y NVIDIA establecen nuevos récords en el benchmark mlperf inference v6.1
El 16 de septiembre de 2026, Wccftech informó que se había lanzado MLPerf Inference v6.1, con AMD y NVIDIA presentando sus resultados. MLPerf Inference es un conjunto de pruebas mantenido por MLCommons para evaluar el rendimiento de la inferencia de IA en diferentes hardware. AMD estableció un nuevo récord con 5,75 millones de tokens por segundo utilizando 512 GPU Instinct MI355X, lo que representa su mayor presentación hasta la fecha. NVIDIA presentó resultados para GB300 y GB200 con 288 GPU, logrando 2,705 millones de tokens por segundo en modo offline y 2,028 millones en modo servidor. La GPU NVIDIA Vera Rubin VR200 también hizo su debut en el benchmark MLPerf, con 72 GPU mostrando un rendimiento un 95% más rápido que GB300.
En la prueba DeepSeek R1, AMD logró 2,902 millones de tokens por segundo en modo offline y 2,405 millones en modo servidor. La GPU NVIDIA VR200, probada con 36 y 72 GPU, superó al GB200 en ambas configuraciones. Estos resultados destacan los avances en las capacidades de inferencia de IA en los principales proveedores de hardware.