AMD e NVIDIA estabelecem novos recordes no benchmark mlperf inference v6.1
Em 16 de setembro de 2026, a Wccftech reportou que a versão 6.1 do MLPerf Inference foi lançada, com as empresas AMD e NVIDIA submetendo resultados. O MLPerf Inference é um conjunto de testes mantido pela MLCommons para avaliar o desempenho de inferência de IA em diferentes hardwares. A AMD estabeleceu um novo recorde com 5,75 milhões de tokens por segundo, utilizando 512 GPUs Instinct MI355X, representando sua maior submissão até então. A NVIDIA submeteu resultados para as GPUs GB300 e GB200, atingindo 2,705 milhões de tokens por segundo no modo offline e 2,028 milhões no modo de servidor. A NVIDIA também apresentou a Vera Rubin VR200 no benchmark MLPerf, com 72 GPUs demonstrando um desempenho 95% superior ao GB300.
No teste DeepSeek R1, a AMD alcançou 2,902 milhões de tokens por segundo no modo offline e 2,405 milhões no modo de servidor. A NVIDIA, com as GPUs VR200 testadas com 36 e 72 unidades, superou o GB200 em ambas as configurações. Estes resultados destacam os avanços nas capacidades de inferência de IA em importantes fabricantes de hardware.