NVIDIA Étend les Capacités d'Inférence Vera Rubin avec Génération Rapide de Tokens
· By Antonio Sedino, CTRO · Published by Reinventy Solutions Corp.
Le système NVIDIA Vera Rubin à l'échelle du rack NVL72 intègre une génération rapide de tokens pour les systèmes agents, annoncé aux côtés de Groq 3 LPX en production complète.

La prochaine ère de l'inférence IA ne sera pas définie par un seul breakthrough puce, réseau ou système. Elle sera définie par la façon dont chaque couche de la usine IA fonctionne ensemble. C'est pourquoi NVIDIA étend Vera Rubin NVL72 avec génération rapide de tokens pour les systèmes agents. Annoncé aujourd'hui, le système NVIDIA Vera Rubin à l'échelle du rack NVL72, avec génération rapide de tokens pour les systèmes agents, Groq 3 LPX en production complète, NVIDIA Extends Vera Rubin Inference for Agents.
