Imprese

AMD e Cerebras: Una Nuova Era per l’Inferenza AI con Helios e Wafer-Scale Engine

AMD e Cerebras Systems presentano una partnership innovativa che promette di rivoluzionare l'inferenza AI grazie all'integrazione di Helios e Wafer-Scale Engine.

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
L'obiettivo è sviluppare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
Quando sarà disponibile la nuova soluzione?
La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Quali sono i vantaggi della nuova architettura proposta?
La nuova architettura promette un incremento fino a cinque volte dei token per secondo per watt rispetto a configurazioni precedenti.

AMD e Cerebras Systems hanno annunciato una partnership tecnica significativa, combinando il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras per sviluppare una soluzione disaggregata per l’inferenza AI. Questa innovativa tecnologia sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.

Secondo i test interni condotti dalle due aziende, l’integrazione proposta potrebbe portare a un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T come riferimento. Questo modello, che utilizza una architettura mixture-of-experts, dispone di un trilione di parametri totali, ma solo circa 32 miliardi attivi per token, con un peso complessivo in INT4 che si aggira intorno ai 500 GB.

Un singolo wafer di Cerebras contiene 44 GB di capacità, il che implica che un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer. Al contrario, un rack Helios è in grado di ospitare il modello molteplici volte, rendendo questa soluzione particolarmente vantaggiosa per modelli più complessi che non possono risiedere interamente su pochi wafer WSE.

La nuova architettura proposta sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in queste fasi, mentre il WSE si focalizza sul decode e sulla generazione dei token. Questo approccio potrebbe rappresentare un passo avanti cruciale per l’ottimizzazione delle performance nei sistemi di inferenza AI.

Nonostante i vantaggi promettenti, è importante notare che ulteriori test comparativi saranno necessari, specialmente rispetto alle offerte rackscale di altri fornitori. Inoltre, i dettagli finanziari dell’accordo tra AMD e Cerebras non sono stati resi noti al pubblico.

Questa partnership arriva in un momento in cui il mercato è sotto i riflettori, con Nvidia che ha recentemente concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. L’annuncio di AMD e Cerebras si inserisce in un contesto di crescente attenzione degli investitori verso il finanziamento circolare nel settore dell’intelligenza artificiale.

Nel frattempo, Cerebras, che è stata quotata a maggio, ha visto oscillazioni significative del suo titolo, mentre AMD continua a mantenere rialzi rilevanti nel valore azionario dall’inizio dell’anno.

redazione

Redazione Energia24Notizie.

Tutti gli articoli dell’autore