Avec Groq 3 LPX en production complète, NVIDIA étend l'inférence Vera Rubin pour les agents
· By Antonio Sedino, CTRO · Published by Reinventy Solutions Corp.
La prochaine ère de l'inférence IA ne sera pas définie par une seule puce révolutionnaire, réseau ou système. Elle sera définie par la façon dont chaque couche de la usine IA fonctionne ensemble. C'est pourquoi NVIDIA étend Vera Rubin NVL72 avec génération rapide de tokens pour les systèmes agents.

La prochaine ère de l'inférence IA ne sera pas définie par une seule puce révolutionnaire, réseau ou système. Elle sera définie par la façon dont chaque couche de la usine IA fonctionne ensemble. C'est pourquoi NVIDIA étend Vera Rubin NVL72 avec génération rapide de tokens pour les systèmes agents. Annoncée aujourd'hui, le système NVIDIA Vera Rubin à l'échelle du rack N...
