Economia

AMD e Cerebras: una nuova era per l’inferenza AI con Helios e Wafer-Scale Engine

di · · Economia, Innovazione

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
L'obiettivo è sviluppare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
Quando sarà disponibile la nuova soluzione?
La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Quali sono i vantaggi della nuova architettura?
La nuova architettura promette un incremento fino a cinque volte dei TPS/W rispetto a configurazioni standalone.

AMD e Cerebras Systems hanno ufficialmente annunciato una partnership tecnica che segna un passo importante nel campo dell’intelligenza artificiale. Questa collaborazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza AI. La nuova tecnologia sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.

Secondo i test interni condotti dalle due aziende, la nuova architettura promette un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T. Questa innovazione si basa su un’architettura che sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in quella fase, mentre il WSE si concentra sul decode e sulla generazione dei token.

Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token e un peso completo in INT4 di circa 500 GB. Un singolo wafer Cerebras contiene 44 GB, il che implica che un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer. Al contrario, un rack Helios può ospitare il modello molte volte, rendendo questo miglioramento particolarmente significativo per modelli che non possono risiedere interamente su pochi wafer WSE.

Le due aziende hanno sottolineato la necessità di ulteriori test comparativi, specialmente rispetto ad altre offerte rackscale disponibili sul mercato. Nonostante i dettagli finanziari dell’accordo non siano stati resi noti, questa collaborazione arriva in un momento in cui Nvidia ha recentemente concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari.

L’annuncio della partnership tra AMD e Cerebras giunge in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’intelligenza artificiale. Nel frattempo, Cerebras, che ha fatto il suo ingresso in borsa a maggio, ha registrato oscillazioni significative del titolo, mentre AMD continua a mantenere rialzi rilevanti del valore azionario dall’inizio dell’anno.

redazione

Redazione di Rassegna Economia.

Tutti gli articoli
Prossimo articolo

Federalismo fiscale: il decreto in Cdm senza l’intesa di Regioni e Comuni