Economia CircolareInnovazione Green

AMD e Cerebras: una nuova era per l’inferenza AI con Helios e Wafer-Scale Engine

redazione 2 min di lettura
AMD e Cerebras partnership per inferenza AI

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
Creare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
Quando sarà disponibile la nuova soluzione per l'inferenza?
La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Quali sono i risultati dei test interni effettuati dalle due aziende?
I test hanno mostrato un aumento fino a cinque volte dei token per secondo per watt rispetto a una configurazione WSE standalone.

AMD e Cerebras Systems hanno recentemente stretto una partnership tecnica che segna un importante passo avanti nel campo dell’intelligenza artificiale. Questa collaborazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza AI, prevista per essere disponibile tramite Cerebras Cloud nella seconda metà del 2026.

In test interni, le due aziende hanno riportato risultati promettenti, evidenziando un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando l’open-source Kimi 2.6 1T, un modello che si distingue per la sua complessità e dimensione.

L’architettura proposta sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando così le minori efficienze del WSE in quella parte del flusso di lavoro. Il WSE, d’altra parte, si concentra sul decode e sulla generazione dei token, ottimizzando così l’intero processo di inferenza.

Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts che vanta un trilione di parametri totali, di cui circa 32 miliardi attivi per token. Il peso completo in INT4 si aggira intorno ai 500 GB. Un singolo wafer Cerebras contiene 44 GB, il che implica che un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer. In contrasto, un rack Helios può ospitare il modello molte volte, rendendo questa soluzione particolarmente significativa per modelli che non possono risiedere interamente su pochi wafer WSE.

Nonostante i risultati promettenti, le aziende riconoscono la necessità di ulteriori test comparativi, soprattutto rispetto alle offerte rackscale di altri fornitori. Inoltre, i termini finanziari dell’accordo non sono stati resi noti, ma il movimento avviene in un contesto di crescente attenzione degli investitori e del mercato sul finanziamento circolare nel settore dell’intelligenza artificiale.

Questa partnership arriva in un momento cruciale, dato che Nvidia ha recentemente concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. Nel frattempo, Cerebras, che è stata quotata a maggio, ha visto oscillazioni significative del suo titolo, mentre AMD continua a mantenere rialzi rilevanti del valore azionario year-to-date.

In conclusione, la collaborazione tra AMD e Cerebras rappresenta un passo importante verso l’ottimizzazione delle prestazioni nell’inferenza AI, con potenziali impatti significativi sul settore.

Scritto da

redazione

Autore della redazione Agenda Ambiente.