Artificial IntelligenceBlog NVIDIA riporta che Alibaba ha rilasciato i pesi del modello Qwen3.8-Flash-Next come anteprima dell'architettura Qwen4 in sviluppo, consentendo agli sviluppatori di sperimentare la nuova architettura sulla piattaforma NVIDIA GB300 NVL72 per la programmazione agente.
Source: NVIDIA Developer Blog ↗Artificial IntelligenceBlog AWS Machine Learning annuncia che Amazon OpenSearch Service supporta ora le MCP Apps, che restituiscono visualizzazioni interattive insieme alle risposte testuali degli agenti AI, abilitando il tracciamento end-to-end dagli avvisi alle cause radice in una singola conversazione.
Source: AWS Machine Learning Blog ↗Artificial IntelligenceOpenAI News riporta che Jalapeño è un chip di inferenza personalizzato che offre una AI inferenza più rapida ed efficiente in termini di potenza, con maggiore throughput e latenza inferiore per i modelli moderni.
Source: OpenAI News ↗Artificial IntelligenceBlog NVIDIA annuncia il sistema rack-scale Vera Rubin con generazione rapida di token per sistemi agente, estendendo la piattaforma con Groq 3 LPX in produzione completa e Spectrum-X NVLink Fusion.
Source: NVIDIA Blog ↗Artificial IntelligenceIntel mostra tre architetture per l'Agentic AI e carichi di lavoro Enterprise-scale, combinando il processore Diamond Rapids per l'orchestrazione ad alte prestazioni, la GPU Crescent Island per l'inferenza efficiente e il SoC Wildcat Lake per il calcolo client intelligente e periferico.
Source: Intel Newsroom ↗Artificial IntelligenceMentre gli agenti AI passano dalla generazione di risposte al raggiungimento di obiettivi autonomamente sempre più complessi, le prestazioni dipendono da quanto efficacemente compute, memoria, software, networking, sicurezza e gestione dell'alimentazione lavorino insieme come un sistema.
Source: Arm Newsroom ↗Artificial IntelligenceI modelli linguistici multimodali di grandi dimensioni usano sempre più spesso la visual chain-of-thought (Visual CoT) per ragionare su ambienti spaziali, temporali e incarnati. Generando immagini di ragionamento intermedie, Visual CoT fornisce un meccanismo intuitivo per la visione prospettica ma introduce un notevole overhead di inferenza.
Source: Apple Machine Learning Research ↗Artificial IntelligenceL'infrastruttura Hugging Face Inference Endpoints, Jobs e Buckets alimenta la funzionalità di ricerca su Papers with Code, abilitando la scoperta efficiente ed esecuzione di modelli machine learning e artefatti di ricerca.
Source: Hugging Face Blog ↗
Artificial IntelligenceQuando un processo motore LLM fallisce, il percorso di recupero standard prevede un cold restart. Questo richiede il caricamento dei pesi nell'HBM dallo storage, la compilazione dei kernel e il reinitialization dello stato di runtime.
Source: NVIDIA Developer Blog ↗Artificial IntelligenceAmazon SageMaker HyperPod ora offre supporto gestito Ray su Amazon EKS. Crea e monitora cluster Ray, connetti JupyterLab e Code Editor notebooks a cluster live, ottieni osservabilità out-of-the-box ed esegui training distribuito resiliente e inferenza accelerata da SageMaker Studio, tutto con open-source KubeRay.
Source: AWS Machine Learning Blog ↗PolicyOpenAI conferma Zero Data Retention per i clienti API idonei e anticipa Private Safety Processing per flussi di lavoro avanzati di sicurezza AI senza compromettere la privacy dei dati.
Source: OpenAI News ↗Advanced MaterialsSecondo i dati di OpenRouter, i carichi di lavoro agentic AI consumano 15x più token di una richiesta chat semplice. Perché? Considera cosa accade quando un agente AI ricerca un'azienda per una decisione di investimento. L'agente query database finanziari, ricerca notizie e filings, invoca un sub-agent per eseguire confronti peer e model valuations.
Source: NVIDIA Blog ↗Artificial IntelligenceIntel Newsroom riporta che il 60% di leader senior di business e IT, specialisti di robotica, funzionari governativi e sanitari si aspettano che le loro organizzazioni operino flotte di robot entro cinque anni, con i leader che prevedono che la distribuzione robotica su larga scala potrebbe raddoppiare l'output operativo.
Source: Intel Newsroom ↗Artificial IntelligenceApple Machine Learning Research esplora metodi per trasferire conoscenze tra lingue quando i dati della lingua target sono scarsi, concentrandosi su ragionamento scientifico, inferenza comune e conoscenza del mondo.
Source: Apple Machine Learning Research ↗Artificial IntelligenceIl blog di Hugging Face annuncia miglioramenti significativi della velocità di inference per il modello LFM2.5-DSpark di LiquidAI.
Source: Hugging Face Blog ↗
Artificial IntelligenceIl blog di NVIDIA Developer descrive progressi nell'hardware e nell'efficienza delle prestazioni AI agent per flussi di lavoro multi-step.
Source: NVIDIA Developer Blog ↗Artificial IntelligenceCatalogo centralizzato per agenti, strumenti e competenze abilitano la scoperta e la governance cross-ambiente su larga scala.
Source: AWS Machine Learning Blog ↗