In Breve
- Qual è l'obiettivo della partnership tra AMD e Cerebras?
- Sviluppare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
- Quando sarà disponibile la nuova soluzione?
- La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
- Quali sono i vantaggi della nuova architettura?
- Promette un aumento fino a cinque volte dei token per secondo per watt rispetto a configurazioni WSE standalone.
AMD e Cerebras Systems hanno recentemente annunciato una partnership tecnica che segna un passo significativo nel campo dell’intelligenza artificiale. Questa collaborazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza che sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.
In test interni, le due aziende hanno riportato un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, misurato sull’open-source Kimi 2.6 1T. Questa architettura innovativa sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in quella parte del flusso, mentre il WSE si concentra sul decode e sulla generazione dei token.
Il confronto è stato effettuato utilizzando Kimi 2.6, un modello di mixture-of-experts con un trilione di parametri totali, ma solo circa 32 miliardi attivi per token. Con un peso completo in INT4 che si aggira intorno ai 500 GB, un singolo wafer Cerebras contiene 44 GB. Pertanto, un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios può ospitare il modello molte volte. Questo miglioramento è particolarmente significativo per modelli che non possono risiedere interamente su pochi wafer WSE, ma potrebbero beneficiare di modelli più densi e compatti.
Tuttavia, è importante notare che sono necessari ulteriori test comparativi, specialmente rispetto alle offerte rackscale di altri fornitori. Non sono stati resi noti i termini finanziari dell’accordo, ma il movimento avviene in un contesto di crescente attenzione degli investitori e del mercato sul finanziamento circolare nel settore dell’AI.
Inoltre, l’annuncio giunge dopo che Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. Nel frattempo, Cerebras, che è stata quotata a maggio, ha visto oscillazioni significative del suo titolo, mentre AMD continua a mantenere rialzi rilevanti del valore azionario year-to-date.
Questa nuova alleanza tra AMD e Cerebras potrebbe dunque rappresentare un punto di svolta nel panorama dell’inferenza AI, promettendo prestazioni superiori e una maggiore efficienza energetica, elementi cruciali per il futuro dello sviluppo dell’intelligenza artificiale.
