AMD e Cerebras Systems hanno recentemente annunciato una partnership tecnica che promette di rivoluzionare il campo dell’inferenza nell’intelligenza artificiale. Questa collaborazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata che sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.
Secondo i test interni condotti dalle due aziende, l’architettura proposta offre un incremento significativo delle prestazioni, con un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando l’open-source Kimi 2.6 1T, un modello di mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token.
L’innovativa architettura sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in questa fase del flusso di lavoro. Nel contempo, il WSE si concentra sul decode e sulla generazione dei token. Questo approccio risulta particolarmente vantaggioso per modelli complessi che non possono risiedere interamente su pochi wafer WSE, ma possono essere gestiti efficacemente con modelli più densi e compatti.
Un singolo wafer Cerebras ha una capacità di 44 GB, il che implica che un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer. In confronto, un rack Helios può ospitare il modello molte volte, rendendo questa soluzione altamente scalabile e adatta a diverse esigenze di elaborazione.
Nonostante i risultati promettenti, le due aziende hanno sottolineato la necessità di ulteriori test comparativi, anche rispetto ad altre soluzioni rackscale disponibili sul mercato. Al momento, non sono stati divulgati i termini finanziari dell’accordo, ma l’annuncio arriva in un contesto di crescente attenzione da parte degli investitori verso il settore dell’intelligenza artificiale.
È interessante notare che questa collaborazione si inserisce in un periodo di movimenti significativi nel mercato, come dimostrato dall’accordo di Nvidia per una licenza non esclusiva sulla tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. Nel frattempo, Cerebras, che è stata quotata a maggio, ha registrato oscillazioni significative del proprio titolo, mentre AMD continua a mantenere rialzi rilevanti nel valore azionario dall’inizio dell’anno.
In conclusione, la partnership tra AMD e Cerebras rappresenta un passo importante verso l’ottimizzazione dell’inferenza AI, con potenziali benefici che potrebbero estendersi a numerosi settori e applicazioni.
