Fino a 30 volte più lavoro per watt: NVIDIA Vera Rubin NVL72 impone un nuovo standard di efficienza per gli agenti AI
· By Antonio Sedino, CTRO · Published by Reinventy Solutions Corp.
Secondo i dati di OpenRouter, i carichi di lavoro agentici AI consumano 15 volte più token di una semplice richiesta di chat. Perché? Prendiamo in considerazione ciò che accade quando un agente AI ricerca un'azienda per una decisione di investimento. L'agente consulta database finanziari, cerca notizie e depositi, invoca un sub-agente per eseguire confronti di peer e valutazioni dei modelli, e sintetizza i risultati.

Secondo i dati di OpenRouter, i carichi di lavoro agentici AI consumano 15 volte più token di una semplice richiesta di chat. Perché? Prendiamo in considerazione ciò che accade quando un agente AI ricerca un'azienda per una decisione di investimento. L'agente consulta database finanziari, cerca notizie e depositi, invoca un sub-agente per eseguire confronti di peer e valutazioni dei modelli, e sintetizza i risultati. Questo modello di ragionamento multi-step e uso di strumenti guida l'aumento significativo della domanda computazionale. La piattaforma NVIDIA Vera Rubin NVL72 mira a questa sfida, offrendo fino a 30 volte più lavoro per watt rispetto alle generazioni precedenti, impostando un nuovo standard di efficienza per la crescente classe di carichi di lavoro agentici AI.
