29 Luglio 2026 | mercoledì
focusenergie.it
Imprese e mercato

AMD e Cerebras: una nuova era per l’inferenza AI con Helios e Wafer-Scale Engine

Di Luglio 29, 20262 min di lettura Imprese e mercato, Innovazione e tecnologia
AMD e Cerebras partnership per inferenza AI

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
Creare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
Quando sarà disponibile la nuova soluzione?
La soluzione sarà disponibile nella seconda metà del 2026 tramite Cerebras Cloud.
Quali sono i vantaggi della nuova architettura?
Promette un aumento fino a cinque volte dei token per secondo per watt rispetto a configurazioni WSE standalone.

AMD e Cerebras Systems hanno annunciato una partnership tecnica che segna un passo significativo nel campo dell’intelligenza artificiale. Questa collaborazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza, prevista per essere disponibile tramite Cerebras Cloud nella seconda metà del 2026.

Secondo test interni condotti dalle due aziende, la nuova architettura promette un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando l’open-source Kimi 2.6 1T, un modello che utilizza una struttura di mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token.

La soluzione proposta sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in queste fasi iniziali del flusso di lavoro. Nel contempo, il WSE si concentra sul decode e sulla generazione dei token, ottimizzando così l’intero processo di inferenza.

Un aspetto interessante riguarda la capacità di gestione dei dati. Un singolo wafer Cerebras ha una capacità di 44 GB, il che significa che un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer. Al contrario, un rack Helios può ospitare il modello molte volte, rendendo la soluzione particolarmente vantaggiosa per modelli che non possono risiedere interamente su pochi wafer WSE.

Nonostante i risultati promettenti, è importante notare che sono necessari ulteriori test comparativi, specialmente rispetto alle offerte rackscale di altri fornitori, per confermare l’efficacia di questa nuova architettura. Inoltre, i termini finanziari dell’accordo tra AMD e Cerebras non sono stati resi noti.

Questa collaborazione arriva in un momento di grande fermento nel settore dell’AI, in particolare dopo che Nvidia ha recentemente concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. Gli investitori e il mercato stanno prestando particolare attenzione al finanziamento circolare nel settore dell’intelligenza artificiale, e le azioni di Cerebras, quotata a maggio, hanno mostrato oscillazioni significative. Nel frattempo, AMD ha registrato un aumento rilevante del valore azionario dall’inizio dell’anno.

redazione

Autore della redazione Focus Energie.

Tutti gli articoli →