NVIDIA Étend la Plateforme d'Inférence Vera Rubin avec Optimisations pour Systèmes Agents
· By Antonio Sedino, CTRO · Published by Reinventy Solutions Corp.
Système à l'échelle du rack NVIDIA Vera Rubin annoncé avec génération rapide de tokens pour les systèmes agents, étendant les capacités d'inférence.

La prochaine ère de l'inférence IA ne sera pas définie par une seule puce révolutionnaire, un réseau ou un système. Elle sera définie par la façon dont chaque couche de la usine IA fonctionne ensemble. C'est pourquoi NVIDIA étend Vera Rubin NVL72 avec génération rapide de tokens pour les systèmes agents. Annoncé aujourd'hui, le système NVIDIA Vera Rubin à l'échelle du rack avec Groq 3 LPX en production complète, NVIDIA Étend l'Inférence Vera Rubin pour les Agents.
