Economia circolare

AMD e Cerebras: una nuova era per l’inferenza AI con Helios e Wafer-Scale Engine

AMD e Cerebras partnership per inferenza AI

In Breve

Qual è la novità principale della partnership tra AMD e Cerebras?
La partnership combina Helios di AMD con il Wafer-Scale Engine di Cerebras per una soluzione disaggregata per l'inferenza AI.
Quando sarà disponibile la nuova soluzione?
La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Quali sono i vantaggi della nuova architettura proposta?
La nuova architettura promette un aumento fino a cinque volte dei token per secondo per watt rispetto a configurazioni precedenti.

AMD e Cerebras Systems hanno recentemente annunciato una partnership tecnica che combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, dando vita a una soluzione disaggregata per l’inferenza. Questa innovazione sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026, promettendo di cambiare le regole del gioco nel campo dell’intelligenza artificiale.

In test interni, le due aziende hanno registrato un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T. Questa architettura proposta sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in quella parte del flusso, mentre il WSE si concentra sul decode e sulla generazione dei token.

Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token. Il peso completo in INT4 è di circa 500 GB; un singolo wafer Cerebras contiene 44 GB, il che significa che un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer. In contrasto, un rack Helios può ospitare il modello molte volte, rendendo questa soluzione particolarmente significativa per modelli che non possono risiedere interamente su pochi wafer WSE.

Tuttavia, gli esperti avvertono che sono necessari ulteriori test comparativi, specialmente rispetto ad altre offerte rackscale di fornitori concorrenti. Nonostante ciò, il miglioramento dichiarato rappresenta un passo avanti notevole per l’ottimizzazione delle risorse nell’ambito dell’intelligenza artificiale.

Non sono stati resi noti i termini finanziari dell’accordo tra AMD e Cerebras. Questo annuncio arriva in un momento di grande attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’AI. Recentemente, Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, evidenziando l’importanza strategica di queste tecnologie.

Inoltre, Cerebras, che è stata quotata a maggio, ha visto oscillazioni significative del suo titolo azionario, mentre AMD continua a mantenere rialzi rilevanti del valore azionario year-to-date. Questo contesto di mercato suggerisce che la competizione nel settore dell’AI si intensificherà ulteriormente nei prossimi mesi, con aziende come AMD e Cerebras pronte a guidare l’innovazione.

redazione

Autore della redazione Eco Scenario.

Leggi tutti gli articoli

Lascia un commento

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *