AI Watch

NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut

NVIDIA AI Zhihan Jiang 5 min de lecture Anglais

Résumé de la publication. Les conditions de NVIDIA AI ne permettent pas de reproduire l'article en intégralité : retrouvez le texte complet sur le site d'origine.

Résumé de la source (Anglais)

System performance, efficient infrastructure scaling and continuous software optimization are key levers that determine AI inference economics. Higher system performance means more tokens generated, resulting in higher revenue. Efficient scaling means throughput grows proportionally as hardware gets added, requiring fewer resources to serve users at scale. Continuous optimization means generating…

Lire l'article complet

blogs.nvidia.com

Voir sur NVIDIA AI (nouvel onglet)