Economia

AMD e Cerebras: una nuova era per l’inferenza AI con Helios e WSE

AMD e Cerebras Systems uniscono le forze per una soluzione innovativa nell’inferenza AI, combinando Helios e Wafer-Scale Engine.

di redazione|
Categorie: Economia, Innovazione
AMD e Cerebras partnership per inferenza AI

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
L'obiettivo è sviluppare una soluzione disaggregata per l'inferenza AI combinando Helios e WSE.
Quando sarà disponibile la nuova soluzione?
La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Quali sono i risultati dei test interni effettuati?
I test hanno mostrato un aumento fino a cinque volte dei token per secondo per watt rispetto a una configurazione WSE standalone.

In un passo significativo per il settore dell’intelligenza artificiale, AMD e Cerebras Systems hanno annunciato una partnership tecnica che promette di rivoluzionare l’inferenza AI. La nuova soluzione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, offrendo un’architettura disaggregata che sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.

Durante i test interni, le due aziende hanno registrato un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T. Questa architettura innovativa sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in queste fasi, mentre il WSE si concentra sul decode e sulla generazione dei token.

Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts che conta un trilione di parametri totali, ma solo circa 32 miliardi attivi per token. Il peso completo in INT4 è di circa 500 GB; un singolo wafer Cerebras contiene 44 GB. Pertanto, un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios può ospitare il modello molteplici volte, rendendo questo miglioramento particolarmente significativo per modelli che non possono essere completamente ospitati su pochi wafer WSE.

Nonostante i risultati promettenti, le due aziende riconoscono la necessità di ulteriori test comparativi, specialmente rispetto alle offerte rackscale di altri fornitori. Inoltre, i dettagli finanziari dell’accordo non sono stati resi noti, ma il movimento avviene in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore AI.

Recentemente, Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, segnalando un’ulteriore competizione nel settore. L’annuncio della partnership tra AMD e Cerebras giunge in un periodo di oscillazioni significative per il titolo di Cerebras, quotato a maggio, mentre AMD continua a registrare rialzi rilevanti del valore azionario year-to-date.

Con questa nuova soluzione, AMD e Cerebras puntano a posizionarsi come leader nel panorama dell’intelligenza artificiale, rispondendo alle crescenti esigenze di potenza di calcolo e efficienza energetica nel settore.

redazione

Autore della redazione de Il Faro Economico.