AMD e Cerebras: Nuova Partnership per l’Inferenza con Helios e Wafer-Scale Engine
In Breve
- Qual è l'obiettivo della partnership tra AMD e Cerebras?
- L'obiettivo è sviluppare una soluzione disaggregata per l'inferenza combinando Helios e Wafer-Scale Engine.
- Quando sarà disponibile la nuova soluzione?
- La soluzione sarà disponibile nella seconda metà del 2026 tramite Cerebras Cloud.
- Quali sono i benefici attesi dalla nuova architettura?
- Si prevede un incremento fino a cinque volte dei token per secondo per watt rispetto a configurazioni WSE standalone.
In un’importante evoluzione nel settore dell’intelligenza artificiale, AMD e Cerebras Systems hanno annunciato una collaborazione tecnica che combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras. Questa innovativa soluzione disaggregata per l’inferenza sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.
Secondo i test interni condotti dalle due aziende, la nuova architettura promette un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando l’open-source Kimi 2.6 1T, un modello che si distingue per la sua complessità e potenza.
La struttura proposta sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in queste fasi, mentre il WSE si concentra sul decode e sulla generazione dei token. Il modello Kimi 2.6, un mixture-of-experts con un trilione di parametri totali, utilizza circa 32 miliardi di parametri attivi per token, con un peso totale in INT4 di circa 500 GB. Un singolo wafer Cerebras contiene 44 GB, il che implica che un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios può ospitare il modello in modo più efficiente.
Questo miglioramento è particolarmente significativo per i modelli che non possono risiedere interamente su pochi wafer WSE, suggerendo la possibilità di utilizzare modelli più densi e compatti. Tuttavia, gli esperti avvertono che sono necessari ulteriori test comparativi, specialmente rispetto alle offerte rackscale di altri fornitori.
Non sono stati resi noti i termini finanziari dell’accordo, ma la notizia arriva in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’AI. Questo annuncio si inserisce in un periodo di significative fluttuazioni nel valore delle azioni di Cerebras, che è stata quotata a maggio, e di AMD, che ha registrato un aumento rilevante del valore azionario year-to-date.
Con questa partnership, AMD e Cerebras puntano a ridefinire gli standard di efficienza e prestazioni nell’inferenza AI, un settore in rapida evoluzione e sempre più competitivo.
