AMD e Cerebras: una nuova era per l’inferenza AI con Helios e Wafer-Scale Engine
In Breve
- Qual è l'obiettivo della partnership tra AMD e Cerebras?
- Creare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
- Quali sono i vantaggi della nuova architettura?
- Aumento fino a cinque volte dei token per secondo per watt rispetto a configurazioni standalone.
- Quando sarà disponibile la soluzione?
- Nella seconda metà del 2026 tramite Cerebras Cloud.
AMD e Cerebras Systems hanno ufficialmente annunciato una partnership tecnica che promette di rivoluzionare il panorama dell’inferenza nell’intelligenza artificiale. Questa collaborazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata che sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Secondo i test interni condotti dalle due aziende, la nuova architettura potrebbe generare un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T come riferimento. Questa soluzione si distingue per la sua capacità di spostare la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando così le minori efficienze del WSE in quelle fasi del flusso di lavoro. Il WSE, invece, si concentrerà sul decode e sulla generazione dei token.
Il modello Kimi 2.6 è un esempio di mixture-of-experts con un trilione di parametri totali, ma solo circa 32 miliardi attivi per token. Considerando che un singolo wafer Cerebras contiene 44 GB di memoria, un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer. Al contrario, un rack Helios può ospitare il modello molte volte, rendendo questa soluzione particolarmente vantaggiosa per modelli che non possono essere completamente gestiti da pochi wafer WSE.
Nonostante i risultati promettenti, è necessario effettuare ulteriori test comparativi, soprattutto rispetto alle offerte rackscale di altri fornitori. I dettagli finanziari dell’accordo tra AMD e Cerebras non sono stati resi noti, ma il contesto di questa partnership è significativo, soprattutto dopo che Nvidia ha recentemente concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari.
Questo annuncio arriva in un momento di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’AI. Cerebras, quotata a maggio, ha mostrato oscillazioni significative del titolo, mentre AMD ha mantenuto un andamento positivo del valore azionario dall’inizio dell’anno.
In conclusione, la partnership tra AMD e Cerebras rappresenta un passo importante verso l’ottimizzazione delle prestazioni nell’ambito dell’intelligenza artificiale, con l’obiettivo di rendere più accessibili e efficienti le soluzioni di inferenza AI per le aziende di tutto il mondo.
