Economia

AMD e Cerebras: una nuova era per l’inferenza AI con Helios e Wafer-Scale Engine

AMD e Cerebras annunciano una nuova soluzione per l'inferenza AI

In Breve

Qual è la novità principale annunciata da AMD e Cerebras?
Hanno lanciato una soluzione disaggregata per l'inferenza AI che combina Helios e Wafer-Scale Engine.
Quando sarà disponibile la nuova soluzione?
La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Quali sono i vantaggi della nuova architettura?
Permette un aumento delle prestazioni fino a cinque volte in termini di TPS/W rispetto a configurazioni precedenti.

AMD e Cerebras Systems hanno annunciato una partnership tecnica che segna un passo significativo nel campo dell’intelligenza artificiale. Questa collaborazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza AI. La nuova tecnologia sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.

In test interni, le due aziende hanno riportato un incremento delle prestazioni fino a cinque volte superiori in termini di token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T. Questa architettura innovativa sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in quella fase del flusso di lavoro, mentre il WSE si concentra sul decode e sulla generazione dei token.

Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts che conta un trilione di parametri totali, ma con circa 32 miliardi di parametri attivi per token. Il peso completo del modello in INT4 è di circa 500 GB. Un singolo wafer di Cerebras contiene 44 GB, il che implica che un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer. Al contrario, un rack Helios è in grado di ospitare il modello molte volte, rendendo questa soluzione particolarmente vantaggiosa per modelli che non possono essere completamente caricati su pochi wafer WSE.

Il miglioramento delle prestazioni è significativo, specialmente per modelli più densi e compatti. Tuttavia, le aziende hanno sottolineato la necessità di ulteriori test comparativi, anche rispetto alle soluzioni rackscale offerte da altri fornitori nel settore.

Non sono stati divulgati i termini finanziari dell’accordo tra AMD e Cerebras. Questo annuncio arriva in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’intelligenza artificiale. Recentemente, Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, sottolineando ulteriormente l’importanza strategica di queste tecnologie nel panorama competitivo attuale.

Nel frattempo, Cerebras, che è stata quotata a maggio, ha registrato oscillazioni significative del suo titolo azionario, mentre AMD continua a mantenere rialzi rilevanti del valore azionario dall’inizio dell’anno.

redazione

Autore di Azienda Italia.