In Breve
- Qual è l'obiettivo della partnership tra AMD e Cerebras?
- Sviluppare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
- Quando sarà disponibile la nuova soluzione?
- La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
- Quali sono i vantaggi della nuova architettura proposta?
- Aumento dell'efficienza energetica e delle prestazioni, con un incremento fino a cinque volte dei TPS/W.
In un annuncio che segna un importante passo avanti nel settore dell’intelligenza artificiale, AMD e Cerebras Systems hanno ufficializzato una partnership tecnica che combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras. Questa innovativa soluzione disaggregata per l’inferenza sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Durante i test interni, le due aziende hanno riportato risultati promettenti, evidenziando un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questi risultati sono stati misurati utilizzando l’open-source Kimi 2.6 1T, un modello di mixture-of-experts con un trilione di parametri totali, ma con circa 32 miliardi di parametri attivi per token e un peso complessivo in INT4 di circa 500 GB.
La nuova architettura proposta sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in questa fase del flusso di lavoro. Il WSE, d’altra parte, si concentra sul decode e sulla generazione dei token, ottimizzando così le prestazioni complessive del sistema.
Un singolo wafer Cerebras contiene 44 GB di capacità, il che significa che un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer. In contrasto, un rack Helios è in grado di ospitare il modello molteplici volte, rendendo questa soluzione particolarmente vantaggiosa per modelli che non possono essere completamente gestiti da pochi wafer WSE. Inoltre, si prevede che questa combinazione possa adattarsi a modelli più densi e compatti, aumentando ulteriormente l’efficienza.
Nonostante i risultati promettenti, le aziende hanno sottolineato la necessità di ulteriori test comparativi, anche rispetto ad altre offerte rackscale presenti sul mercato. Al momento, i termini finanziari dell’accordo tra AMD e Cerebras non sono stati resi pubblici.
Questo annuncio giunge in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’AI. Recentemente, Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, evidenziando l’importanza strategica di queste tecnologie nel panorama competitivo attuale.
Inoltre, Cerebras, che è stata quotata a maggio, ha visto oscillazioni significative del suo titolo, mentre AMD continua a registrare rialzi rilevanti del valore azionario year-to-date. Questi sviluppi potrebbero avere un impatto significativo sul futuro del settore dell’intelligenza artificiale e sulle tecnologie di inferenza.
