In Breve
- Qual è la novità annunciata da AMD e Cerebras?
- AMD e Cerebras hanno annunciato una partnership per una soluzione disaggregata nell'inferenza AI.
- Quali sono i vantaggi della nuova soluzione?
- La soluzione promette un aumento fino a cinque volte dei TPS/W rispetto a configurazioni WSE standalone.
- Quando sarà disponibile la soluzione?
- La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
In un annuncio che segna un passo significativo nel campo dell’intelligenza artificiale, AMD e Cerebras Systems hanno ufficializzato una partnership tecnica che integra il sistema rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras. Questa nuova soluzione disaggregata per l’inferenza sarà disponibile attraverso il Cerebras Cloud nella seconda metà del 2026.
Le due aziende hanno riportato risultati promettenti dai test interni, evidenziando un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando l’open-source Kimi 2.6 1T, un modello di mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token.
L’architettura proposta sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in queste fasi, mentre il WSE si concentra sul decode e sulla generazione dei token. Un singolo wafer Cerebras ha una capacità di 44 GB, rendendo necessaria l’implementazione di oltre una dozzina di wafer per un’implementazione esclusivamente WSE. In confronto, un rack Helios può ospitare il modello molte volte, rendendo questa soluzione particolarmente vantaggiosa per modelli che non possono risiedere interamente su pochi wafer WSE.
Questa innovazione è di particolare rilevanza per i modelli AI più complessi, che richiedono una maggiore densità e compattezza. Tuttavia, i test comparativi con le offerte rackscale di altri fornitori saranno fondamentali per valutare l’efficacia complessiva della soluzione proposta.
Nonostante l’entusiasmo per questa collaborazione, i termini finanziari dell’accordo non sono stati divulgati. Questo annuncio arriva in un momento critico, in cui Nvidia ha recentemente concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. La situazione attuale del mercato evidenzia un crescente interesse degli investitori nel settore dell’AI, con Cerebras che ha visto oscillazioni significative del suo titolo dopo la quotazione di maggio, mentre AMD continua a registrare rialzi rilevanti nel valore azionario dall’inizio dell’anno.

