In Breve
- Qual è l'obiettivo della partnership tra AMD e Cerebras?
- Migliorare l'efficienza nell'inferenza AI combinando Helios e Wafer-Scale Engine.
- Quando sarà disponibile la nuova soluzione?
- Nella seconda metà del 2026 tramite Cerebras Cloud.
- Qual è il miglioramento delle prestazioni registrato?
- Fino a cinque volte i token per secondo per watt rispetto a una configurazione WSE standalone.
AMD e Cerebras Systems hanno recentemente annunciato una partnership strategica volta a migliorare l’efficienza nell’inferenza AI. Questa collaborazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata che sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Durante i test interni, le due aziende hanno registrato un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando l’open-source Kimi 2.6 1T, un modello avanzato di machine learning.
La nuova architettura proposta sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in quella parte del flusso di lavoro. Il WSE, invece, si concentra sul decode e sulla generazione dei token, ottimizzando così l’intero processo.
Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts che conta un trilione di parametri totali, ma attiva circa 32 miliardi per token. Con un peso completo in INT4 di circa 500 GB, un singolo wafer Cerebras contiene 44 GB di dati. Pertanto, un’implementazione esclusivamente basata sul WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios può ospitare il modello molte volte, rendendo questa soluzione particolarmente vantaggiosa per modelli più densi e compatti.
Nonostante i risultati promettenti, le aziende hanno sottolineato che sono necessari ulteriori test comparativi, specialmente rispetto alle offerte rackscale di altri fornitori. Inoltre, i termini finanziari dell’accordo non sono stati resi noti.
Questa partnership arriva in un momento in cui il mercato è particolarmente attento agli sviluppi nel settore dell’intelligenza artificiale. Recentemente, Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, evidenziando l’importanza strategica di tali tecnologie.
Inoltre, Cerebras, quotata a maggio, ha registrato oscillazioni significative del titolo, mentre AMD continua a mantenere un trend di rialzo nel valore azionario year-to-date. Questa collaborazione potrebbe rappresentare un passo cruciale per entrambe le aziende nel competitivo panorama dell’AI.
