Bitget App
Trade smarter
Acquista CryptoMercatiTradingFuturesEarnPlazaAltro
Superando le GPU con una velocità dei token 30 volte superiore! BNP Paribas elogia Cerebras (CBRS.US) CS-4 per l’inizio dell’era del “wafer-scale + inferenza disaccoppiata”

Superando le GPU con una velocità dei token 30 volte superiore! BNP Paribas elogia Cerebras (CBRS.US) CS-4 per l’inizio dell’era del “wafer-scale + inferenza disaccoppiata”

智通财经智通财经2026/08/20 06:46
Mostra l'originale

Dopo l'evento Supernova Day tenutosi martedì dalla società di chip per intelligenza artificiale (AI) Cerebras Systems, BNP Paribas ha dichiarato di essere rimasta profondamente colpita dai partner annunciati e dagli annunci correlati della società.

Secondo quanto riportato da Zhihui Finance APP, dopo che Cerebras Systems (CBRS.US), azienda di chip per l'intelligenza artificiale (AI), ha organizzato l'evento Supernova Day martedì, BNP Paribas ha dichiarato che i partner annunciati e i relativi comunicati dell'azienda le hanno lasciato un'impressione profonda.

Karl Ackerman, analista di BNP Paribas, ha scritto in un rapporto ai clienti: "Proprio come il LPU di NVIDIA (NVDA.US), le nuove collaborazioni di Cerebras con OpenAI, Amazon (AMZN.US) AWS e AMD (AMZ.US) evidenziano una domanda crescente nel mercato per migliorare le fasi di decodifica altamente sensibili alla latenza nel processo di inferenza."

L'analista ha inoltre affermato che, per quanto riguarda l'inferenza rapida, il nuovo Wafer-Scale Engine CS-4 basato su SRAM, annunciato di recente, offre una straordinaria larghezza di banda della memoria on-chip di 43,2 PB/s e dispone di una nuova interfaccia di I/O per wafer che sfrutta RDMA. Cerebras ha dichiarato con orgoglio che il sistema CS-4 genera token 30 volte più velocemente rispetto ai sistemi GPU attualmente utilizzati in produzione.

Inoltre, l'analista ha affermato che il piano di sviluppo di Cerebras, che raddoppia la performance ogni anno e punta ad aumentare la capacità di throughput di 20 volte entro il 2027, è ammirevole. Secondo l'analista: "Cerebras è focalizzata sull'inferenza decoupled, posizionando il suo Wafer-Scale Engine come motore di decodifica ad altissima velocità per una generazione rapida di token, lavorando insieme a sistemi ad alta intensità computazionale come AWS Trainium o AMD Helios. Cerebras afferma che il suo sistema di inferenza decoupled sarà fino a 10 volte più veloce delle GPU e migliorerà le performance di 5 volte rispetto alle configurazioni che utilizzano solo WSE."

Infine, l'analista ha dichiarato che Arista Networks (ANET.US) è diventata il partner di rete "chiave" di Cerebras e prevede che nel tempo questa collaborazione aiuterà Arista ad espandere nuovi scenari applicativi per i clienti.

È stato riferito che martedì, durante l'evento Supernova Day, Cerebras ha ufficialmente lanciato il nuovo sistema AI di livello rack Cerebras CS-4, presentato come "il più veloce acceleratore AI del settore". Il sistema è rivolto alla corsa delle inferenze con modelli di grandi dimensioni, puntando direttamente ai prodotti server GPU di NVIDIA. Durante l'evento, Cerebras ha annunciato anche partnership con OpenAI, AMD, Arista Networks, AWS, Figma, Cognition e CrowdStrike.

CS-4 è il primo prodotto dell'architettura di piattaforma rack di nuova generazione Nexus di Cerebras, alimentato da tre nuovi processori Wafer Scale Engine 3 Turbo (WSE-3T). Il WSE-3T è il processore AI più grande mai realizzato, con ogni chip che integra 4 trilioni di transistor e 900.000 core ottimizzati per AI, coprendo 46.225 millimetri quadrati di silicio e includendo 44GB di SRAM. Il sistema CS-4 offre 750 PFLOPs di potenza di calcolo AI, una larghezza di banda della memoria di 129,6 PB al secondo e una capacità di I/O di 7,2 Tbps al secondo. La potenza di calcolo AI del singolo chip WSE-3T è raddoppiata rispetto alla generazione precedente, da 125 PFLOPS a 250 PFLOPS, mentre la larghezza di banda della memoria è aumentata da 21,6 PB/s a 43,2 PB/s.

Cerebras afferma che CS-4 ha stabilito un nuovo standard di riferimento nell'industria per la velocità d'inferenza. Nei test di confronto diretto sul modello GPT-OSS-120B, CS-4 può generare più di 4.400 token per utente al secondo, fino a 30 volte rispetto alle soluzioni GPU. Il sistema supporta modelli con oltre 50 trilioni di parametri. Rispetto al CS-3 della generazione precedente, CS-4 ha raddoppiato la velocità, aumentato di 10 volte la capacità per watt e migliorato significativamente l'efficienza economica del data center.

0
0

Esclusione di responsabilità: il contenuto di questo articolo riflette esclusivamente l’opinione dell’autore e non rappresenta in alcun modo la piattaforma. Questo articolo non deve essere utilizzato come riferimento per prendere decisioni di investimento.

PoolX: Blocca per guadagnare
Almeno il 12% di APR. Sempre disponibile, ottieni sempre un airdrop.
Blocca ora!

Ti potrebbe interessare anche

Moderna scende di oltre il 13% nel pre-market

Chaincatcher2026/08/20 08:29

SK hynix (SKHY.US) annuncia un riacquisto da 40 trilioni, “fa esplodere il mercato”; JPMorgan: entro il 2027 potrebbe distribuire altri 130 miliardi di dollari in bonus

Dopo che SK Hynix (SKHY.US) ha lanciato mercoledì il suo più recente piano di riacquisto di azioni su larga scala, JPMorgan ha indicato che la società è destinata a fornire agli azionisti almeno 130 billions di dollari (circa 180 mila miliardi di won) in ricompense entro il prossimo anno.

智通财经2026/08/20 08:16
SK hynix (SKHY.US) annuncia un riacquisto da 40 trilioni, “fa esplodere il mercato”; JPMorgan: entro il 2027 potrebbe distribuire altri 130 miliardi di dollari in bonus