In Breve
- Qual è l'obiettivo della partnership tra AMD e Cerebras?
- Sviluppare una soluzione disaggregata per l'inferenza AI.
- Quando sarà disponibile la nuova soluzione?
- Nella seconda metà del 2026.
- Quali sono i vantaggi della nuova architettura?
- Fino a cinque volte più token per secondo per watt rispetto a configurazioni WSE standalone.
In un annuncio che segna un passo avanti significativo nel campo dell’intelligenza artificiale, AMD e Cerebras Systems hanno ufficializzato una partnership tecnica mirata a combinare il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras. Questa innovativa soluzione disaggregata per l’inferenza sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Secondo i test interni condotti dalle due aziende, la nuova architettura promette un incremento delle prestazioni fino a cinque volte in termini di token per secondo per watt (TPS/W), rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando il modello open-source Kimi 2.6 1T, un sistema di machine learning con un trilione di parametri totali, di cui circa 32 miliardi attivi per token.
La strategia adottata prevede lo spostamento della fase di prefill e dell’elaborazione dei prompt sul rack Helios, il quale compensa le minori efficienze del WSE in queste fasi, mentre il WSE si concentra sul decode e sulla generazione dei token. Questa architettura è particolarmente vantaggiosa per i modelli complessi che non possono essere completamente gestiti da pochi wafer WSE, dato che un singolo wafer Cerebras contiene 44 GB di memoria. Pertanto, un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios è in grado di ospitare il modello molteplici volte.
Il miglioramento delle prestazioni è di particolare rilevanza per i modelli che necessitano di maggiore densità e compattezza. Tuttavia, le aziende hanno sottolineato la necessità di ulteriori test comparativi, anche rispetto ad altre offerte rackscale disponibili sul mercato.
Non sono stati resi noti i dettagli finanziari dell’accordo tra AMD e Cerebras. Questo annuncio arriva in un contesto di crescente attenzione da parte degli investitori riguardo al settore dell’intelligenza artificiale, in particolare dopo che Nvidia ha recentemente concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari.
Inoltre, la situazione di mercato è caratterizzata da oscillazioni significative per Cerebras, che è stata quotata a maggio, mentre AMD continua a registrare un aumento del valore azionario year-to-date. Questo scenario evidenzia l’importanza strategica della collaborazione tra queste due aziende nel panorama dell’innovazione tecnologica.
