Newsletter
Economia

AMD e Cerebras: una nuova era per l’inferenza AI con Helios e Wafer-Scale Engine

AMD e Cerebras annunciano partnership per inferenza AI

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
L'obiettivo è combinare Helios e Wafer-Scale Engine per migliorare l'inferenza AI.
Quando sarà disponibile la nuova soluzione disaggregata?
La soluzione sarà disponibile nella seconda metà del 2026.
Quali sono i vantaggi attesi da questa nuova architettura?
Si prevede un incremento fino a cinque volte dei TPS/W rispetto a configurazioni precedenti.

Nel panorama in continua evoluzione dell’intelligenza artificiale, AMD e Cerebras Systems hanno recentemente annunciato una partnership strategica che promette di trasformare il modo in cui vengono gestite le operazioni di inferenza. Combinando il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, questa nuova soluzione disaggregata sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.

Secondo i test interni condotti dalle due aziende, la nuova architettura potrebbe offrire un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando il modello open-source Kimi 2.6 1T, un sistema che utilizza un trilione di parametri totali, con circa 32 miliardi attivi per token.

La proposta architetturale prevede di spostare la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando così le minori efficienze del WSE in quella fase del flusso di lavoro. Il WSE, d’altra parte, si concentrerà sul decode e sulla generazione dei token, ottimizzando ulteriormente le prestazioni complessive del sistema.

Un aspetto cruciale di questa innovazione è rappresentato dalla gestione dei dati. Un singolo wafer Cerebras contiene 44 GB di memoria, il che implica che un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer per gestire appieno il modello. In contrasto, un rack Helios ha la capacità di ospitare il modello molte volte, rendendo questa soluzione particolarmente significativa per i modelli che non possono essere completamente caricati su pochi wafer WSE.

Nonostante i risultati promettenti, le due aziende hanno sottolineato la necessità di ulteriori test comparativi, specialmente in relazione ad altre offerte rackscale disponibili sul mercato. Questo è particolarmente rilevante in un contesto in cui Nvidia ha recentemente stipulato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari.

L’annuncio di questa partnership arriva in un momento di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’intelligenza artificiale. Cerebras, che è stata quotata in borsa a maggio, ha registrato oscillazioni significative del suo titolo, mentre AMD continua a beneficiare di un aumento rilevante del valore azionario dall’inizio dell’anno.

In conclusione, la collaborazione tra AMD e Cerebras rappresenta un passo avanti significativo nel campo dell’inferenza AI, promettendo non solo prestazioni superiori ma anche un’efficienza energetica migliorata, elementi chiave per il futuro dello sviluppo tecnologico in questo settore.

redazione

Autore de La Bussola Economica.

Prossimo articolo Il Piemonte approva il Piano per la qualità dell’aria: misure alternative al blocco degli Euro 5