In Breve
- Qual è l'obiettivo della partnership tra AMD e Cerebras?
- Creare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
- Quando sarà disponibile la nuova soluzione?
- Nella seconda metà del 2026 attraverso Cerebras Cloud.
- Quali sono i vantaggi della nuova architettura?
- Incremento fino a cinque volte dei token per secondo per watt rispetto a configurazioni standalone.
AMD e Cerebras Systems hanno ufficialmente annunciato una partnership tecnica che segna un importante passo avanti nel campo dell’intelligenza artificiale. Questa collaborazione mira a combinare il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza AI. La nuova tecnologia sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.
Secondo i test interni condotti dalle due aziende, la nuova architettura promette un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando l’open-source Kimi 2.6 1T, un modello di AI che sfrutta una configurazione di mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token.
La soluzione proposta prevede un’architettura innovativa che sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios. Questo approccio consente di compensare le minori efficienze del WSE in quella parte del flusso, mentre il WSE si concentra sul decode e sulla generazione dei token. Un singolo wafer Cerebras contiene 44 GB di capacità, il che significa che un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios può ospitare il modello molte volte, rendendo questa soluzione particolarmente vantaggiosa per modelli complessi.
Il miglioramento delle prestazioni è significativo, soprattutto per modelli che non possono risiedere interamente su pochi wafer WSE. Tuttavia, per una valutazione completa, saranno necessari ulteriori test comparativi, specialmente rispetto ad altre offerte rackscale disponibili sul mercato.
Nonostante l’innovazione, i termini finanziari dell’accordo tra AMD e Cerebras non sono stati resi noti. Questo annuncio arriva in un momento di grande attenzione da parte degli investitori e del mercato nei confronti del finanziamento circolare nel settore dell’intelligenza artificiale. Recentemente, Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, segnalando un crescente interesse per le tecnologie avanzate nel campo dell’AI.
Inoltre, Cerebras, che è stata quotata in borsa a maggio, ha registrato oscillazioni significative del suo titolo, mentre AMD continua a mantenere rialzi rilevanti del valore azionario dall’inizio dell’anno. Questa partnership potrebbe rappresentare un ulteriore impulso per entrambe le aziende, contribuendo a consolidare la loro posizione nel competitivo mercato dell’intelligenza artificiale.

