Imprese

AMD e Cerebras: Una Nuova Era per l’Inferenza AI con la Soluzione Disaggregata

AMD e Cerebras annunciano una nuova soluzione per l'inferenza AI

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
L'obiettivo è sviluppare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
Quando sarà disponibile la nuova soluzione?
La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Quali sono i vantaggi della nuova architettura?
La nuova architettura aumenta l'efficienza energetica e le prestazioni fino a cinque volte rispetto a configurazioni precedenti.

In un annuncio che potrebbe segnare una svolta nel settore dell’intelligenza artificiale, AMD e Cerebras Systems hanno ufficializzato una partnership tecnica che integra il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras. Questa innovativa soluzione disaggregata per l’inferenza sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.

Le due aziende hanno condotto test interni che mostrano un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T. Questa architettura avanzata sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, ottimizzando così le prestazioni del WSE, che si concentra principalmente sul decode e sulla generazione dei token.

Il modello Kimi 2.6, un esempio di mixture-of-experts, presenta un trilione di parametri, ma solo circa 32 miliardi di essi attivi per ogni token, con un peso complessivo in INT4 di circa 500 GB. Un singolo wafer Cerebras contiene 44 GB, il che implica che un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios è in grado di ospitare il modello molteplici volte.

Questa soluzione si rivela particolarmente vantaggiosa per modelli che non possono essere completamente ospitati su pochi wafer WSE, rendendo possibile l’uso di modelli più densi e compatti. Tuttavia, gli esperti avvertono che sono necessari ulteriori test comparativi, specialmente rispetto alle offerte rackscale di altri fornitori.

Non sono stati divulgati i dettagli finanziari dell’accordo tra AMD e Cerebras, ma l’annuncio arriva in un contesto di crescente attenzione da parte degli investitori e del mercato riguardo al finanziamento circolare nel settore dell’AI. Recentemente, Nvidia ha siglato un accordo per una licenza non esclusiva sulla tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, evidenziando la competizione in rapida evoluzione nel campo.

Nel frattempo, Cerebras, che è stata quotata a maggio, ha registrato significative oscillazioni del titolo, mentre AMD continua a mantenere un rialzo rilevante del valore azionario dall’inizio dell’anno.

Autore

redazione

Redazione di Nuova Innova.