Reinventy Solutions Corp. · Technology intelligencePrivate control
ReinventyHERALD
Evidence-led daily edition
← Front pageArtificial Intelligence

NVIDIA Étend les Capacités d'Inférence Vera Rubin avec Génération Rapide de Tokens

· By Antonio Sedino, CTRO · Published by Reinventy Solutions Corp.

Le système NVIDIA Vera Rubin à l'échelle du rack NVL72 intègre une génération rapide de tokens pour les systèmes agents, annoncé aux côtés de Groq 3 LPX en production complète.

NVIDIA Extends Vera Rubin Inference for Agents with Groq 3 LPX

La prochaine ère de l'inférence IA ne sera pas définie par un seul breakthrough puce, réseau ou système. Elle sera définie par la façon dont chaque couche de la usine IA fonctionne ensemble. C'est pourquoi NVIDIA étend Vera Rubin NVL72 avec génération rapide de tokens pour les systèmes agents. Annoncé aujourd'hui, le système NVIDIA Vera Rubin à l'échelle du rack NVL72, avec génération rapide de tokens pour les systèmes agents, Groq 3 LPX en production complète, NVIDIA Extends Vera Rubin Inference for Agents.

Read the original source at NVIDIA Blog ↗