In Breve
- Qual è l'obiettivo della partnership tra AMD e Cerebras?
- Sviluppare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
- Quando sarà disponibile la nuova soluzione?
- Nella seconda metà del 2026 attraverso Cerebras Cloud.
- Quali sono i principali vantaggi della nuova architettura?
- Aumento delle prestazioni fino a cinque volte in TPS/W rispetto a configurazioni standalone.
In un annuncio che segna un passo significativo nel campo dell’intelligenza artificiale, AMD e Cerebras Systems hanno presentato una partnership tecnica finalizzata a migliorare l’inferenza AI. Questa collaborazione combina il sistema rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata che sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.
Durante i test interni, le due aziende hanno riportato un incremento delle prestazioni fino a cinque volte in termini di token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando il modello open-source Kimi 2.6 1T, un sistema di mixture-of-experts che conta un trilione di parametri, di cui circa 32 miliardi attivi per token.
La nuova architettura proposta si distingue per il suo approccio innovativo: sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando così le minori efficienze del WSE in queste fasi iniziali. Il WSE, d’altra parte, si concentra sul decode e sulla generazione dei token. Questo modello è particolarmente utile per le applicazioni che richiedono una gestione efficiente di grandi volumi di dati.
Un singolo wafer Cerebras ha una capacità di 44 GB, il che significa che un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer. Al contrario, un rack Helios è in grado di ospitare il modello molte volte, rendendo questa soluzione particolarmente vantaggiosa per modelli più densi e compatti.
Tuttavia, è importante notare che sono necessari ulteriori test comparativi per valutare le prestazioni rispetto ad altre offerte rackscale disponibili sul mercato. Non sono stati resi noti i termini finanziari dell’accordo, ma il movimento arriva in un contesto di crescente attenzione degli investitori verso il settore dell’AI, in particolare dopo che Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari.
Questo annuncio giunge in un periodo di fluttuazioni significative per Cerebras, che è stata quotata a maggio, e per AMD, che ha visto un aumento rilevante del valore azionario dall’inizio dell’anno. La partnership tra le due aziende potrebbe rappresentare un cambiamento fondamentale nel modo in cui l’inferenza AI viene gestita, aprendo la strada a nuove possibilità nel campo della tecnologia e dell’economia.
