Economia

AMD e Cerebras: una nuova era per l’inferenza AI con Helios e Wafer-Scale Engine

di redazione Luglio 29, 2026 Categorie: Economia, Innovazione

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
Sviluppare una soluzione disaggregata per l'inferenza AI che migliora le prestazioni.
Quando sarà disponibile la nuova soluzione?
Nella seconda metà del 2026 tramite Cerebras Cloud.
Quali miglioramenti sono stati riportati nei test?
Fino a cinque volte l'aumento dei token per secondo per watt rispetto a configurazioni standalone.

In un passo significativo per il settore dell’intelligenza artificiale, AMD e Cerebras Systems hanno annunciato una collaborazione tecnica che combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras. Questa soluzione disaggregata per l’inferenza sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.

Durante i test interni, le due aziende hanno riportato un miglioramento delle prestazioni, con un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T.

L’architettura proposta ottimizza il flusso di lavoro spostando la fase di prefill e l’elaborazione dei prompt sul rack Helios, mentre il WSE si concentra sul decode e sulla generazione dei token. Questo approccio risulta particolarmente vantaggioso per i modelli di intelligenza artificiale che richiedono una capacità di elaborazione superiore, poiché un singolo wafer Cerebras contiene solo 44 GB di memoria, rendendo necessaria una configurazione complessa per modelli più grandi.

Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts con un trilione di parametri totali, ma solo circa 32 miliardi attivi per token. Di conseguenza, un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios può ospitare il modello molte volte, ottimizzando l’efficienza.

Nonostante i risultati promettenti, gli esperti avvertono che sono necessari ulteriori test comparativi, specialmente rispetto ad altre soluzioni rackscale disponibili sul mercato. Inoltre, i dettagli finanziari dell’accordo tra AMD e Cerebras non sono stati resi noti.

Questo annuncio arriva in un contesto di crescente attenzione da parte degli investitori verso il settore dell’intelligenza artificiale, in particolare dopo che Nvidia ha siglato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. Nel frattempo, Cerebras, quotata a maggio, ha registrato oscillazioni significative del titolo, mentre AMD continua a mostrare un aumento rilevante del valore azionario dall’inizio dell’anno.

Con questa partnership, AMD e Cerebras puntano a ridefinire le capacità di inferenza AI, promettendo soluzioni più scalabili e performanti per le esigenze future del mercato.

redazione

Profilo autore e archivio degli articoli pubblicati su Impresa Monitor.