In Breve
- Qual è la novità annunciata da AMD e Cerebras?
- Hanno lanciato una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
- Quando sarà disponibile la nuova soluzione?
- La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
- Quali sono i vantaggi della nuova architettura?
- L'architettura offre un incremento fino a cinque volte nei TPS/W rispetto a una configurazione WSE standalone.
In un’importante svolta nel settore dell’intelligenza artificiale, AMD e Cerebras Systems hanno annunciato una partnership tecnica che combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras. Questa innovativa soluzione disaggregata per l’inferenza sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.
Durante i test interni, le due aziende hanno riportato un incremento fino a cinque volte nei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T. Questa architettura avanzata sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in queste fasi, mentre il WSE si concentra sul decode e sulla generazione dei token.
Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts con un trilione di parametri totali, ma solo circa 32 miliardi attivi per token. Il peso completo in INT4 è di circa 500 GB; un singolo wafer Cerebras contiene 44 GB, il che implica che un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer. Al contrario, un rack Helios può ospitare il modello molte volte, rendendo questo miglioramento particolarmente significativo per modelli che non possono risiedere interamente su pochi wafer WSE.
Nonostante i risultati promettenti, sono necessari ulteriori test comparativi, soprattutto rispetto alle offerte rackscale di altri fornitori. I termini finanziari dell’accordo non sono stati resi noti, ma questa collaborazione arriva in un momento in cui il settore dell’AI sta attirando l’attenzione degli investitori, in particolare dopo che Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari.
L’annuncio di questa partnership giunge in un contesto di crescente interesse per il finanziamento circolare nel settore AI. Nel frattempo, Cerebras, quotata a maggio, ha registrato oscillazioni significative del titolo, mentre AMD continua a mantenere rialzi rilevanti del valore azionario year-to-date.
