Bitget App
Mag-trade nang mas matalino
Buy cryptoMarketsTradeFuturesEarnSquareMore
30 na beses na bilis ng Token hinahamon ang GPU trono! Pinuri ng BNP Paribas ang Cerebras (CBRS.US) CS-4 para sa pagsisimula ng “wafer-level + decoupled inference” na panahon

30 na beses na bilis ng Token hinahamon ang GPU trono! Pinuri ng BNP Paribas ang Cerebras (CBRS.US) CS-4 para sa pagsisimula ng “wafer-level + decoupled inference” na panahon

智通财经智通财经2026/08/20 06:46
Ipakita ang orihinal

Matapos ang Supernova Day na isinagawa ng artificial intelligence (AI) chip company na Cerebras Systems noong Martes, sinabi ng BNP Paribas na labis silang napahanga sa mga ipinahayag na partner at mga kaugnay na anunsyo ng kumpanya.

Ayon sa Jinse Finance APP, pagkatapos ng Supernova Day event na isinagawa ng kumpanya ng Artificial Intelligence (AI) chip na Cerebras Systems (CBRS.US) noong Martes, sinabi ng BNP Paribas na labis silang humanga sa mga partner at mga kaugnay na anunsyong inilabas ng kumpanya.

Isinulat ng analyst ng BNP Paribas, si Karl Ackerman, sa isang ulat para sa mga kliyente: "Tulad ng LPU ng Nvidia (NVDA.US), ipinapakita ng mga bagong partnership ng Cerebras sa OpenAI, Amazon (AMZN.US) AWS, at AMD (AMZ.US) na tumataas ang pangangailangan ng market para sa pagbuti ng proseso ng inference, partikular sa mga decoding stage na napaka-sensitibo sa latency."

Dagdag pa ng analyst, pagdating sa mabilis na inference, ang bagong inilabas na SRAM-based CS-4 Wafer-Scale Engine ay nagbibigay ng "nakakamanghang 43.2 PB/s on-chip memory bandwidth," at may bagong wafer I/O interface na gumagamit ng RDMA. Ipinagmamalaki ng Cerebras na mas mabilis gumawa ng Token ang CS-4 system—30 beses kaysa sa kasalukuyang GPU systems sa production environment.

Bukod dito, sinabi ng analyst na kahanga-hanga ang roadmap ng produkto ng Cerebras dahil doble ang pagtaas ng performance kada taon, at plano nilang pagbutihin ang throughput ng 20 beses pagsapit ng 2027. Sabi ng analyst: "Nakatuon ang Cerebras sa disaggregated inference sa pamamagitan ng pagposisyon ng kanilang Wafer-Scale Engine bilang ultra-high-speed decoding engine para sa mabilis na Token generation, at nakikipag-collaborate sa computationally intensive systems gaya ng AWS Trainium o AMD Helios. Sabi ng Cerebras, ang kanilang disaggregated inference system ay inaasahang hanggang 10 beses na mas mabilis kaysa sa GPU, at 5 beses ang pagtaas ng performance kumpara sa WSE-only configuration."

Sa huli, sinabi ng analyst na ang Arista Networks (ANET.US) ay naging "key" network partner ng Cerebras, at inaasahang tutulong ito sa Arista na mapalawak ang application scenarios ng kanilang customer base sa paglipas ng panahon.

Ayon sa report, opisyal na inilunsad ng Cerebras sa Supernova Day event noong Martes ang bagong generation rack-level AI system na Cerebras CS-4, na tinatawag nila "pinakamabilis na AI accelerator sa industriya." Ang sistema ay nilalapat para sa mga malalaking model inference scenario at direkta itong kinokompetensya ang GPU server products ng Nvidia. Bukod dito, ipinahayag din ng Cerebras sa event ang mga partnership nila sa OpenAI, AMD, Arista Networks, AWS, Figma, Cognition, at CrowdStrike.

Ang CS-4 ay unang produkto ng bagong generation Nexus rack-level platform architecture ng Cerebras, pinapatakbo ng tatlong bagong Wafer Scale Engine 3 Turbo (WSE-3T) wafer-level processors. Ang WSE-3T ang pinakamalaking AI processor sa kasaysayan, bawat chip ay may 4 trillion transistors at 900 thousand AI-optimized cores, sumasakop sa 46,225 square millimeters ng silicon area, at may built-in na 44GB SRAM. Ang CS-4 system ay naglalaman ng 750 PFLOPs ng AI computing power, 129.6 PB per second na memory bandwidth, at 7.2 Tbps per second na I/O throughput. Ang AI computing power ng isang WSE-3T chip ay nadoble mula 125 PFLOPS ng nakaraang generation tungo sa 250 PFLOPS, at ang memory bandwidth ay nadoble mula 21.6 PB/s tungo sa 43.2 PB/s.

Ipinagmamalaki ng Cerebras na ang CS-4 ay nagtakda ng bagong industry benchmark sa inference speed. Sa direct comparative test sa GPT-OSS-120B model, kayang makagawa ang CS-4 ng mahigit 4,400 tokens kada user bawat segundo, hanggang 30 beses kaysa sa GPU scheme. Sinusuportahan ng system ang higit sa 50 trillion parameters ng model. Kumpara sa nakaraang CS-3, doble ang bilis ng CS-4, sampung beses ang taas ng throughput kada watt, at malaki ang naitulong sa economic efficiency ng data centers.

0
0

Disclaimer: Ang nilalaman ng artikulong ito ay sumasalamin lamang sa opinyon ng author at hindi kumakatawan sa platform sa anumang kapasidad. Ang artikulong ito ay hindi nilayon na magsilbi bilang isang sanggunian para sa paggawa ng mga desisyon sa investment.

PoolX: Naka-lock para sa mga bagong token.
Hanggang 12%. Palaging naka-on, laging may airdrop.
Mag Locked na ngayon!

Baka magustuhan mo rin

Ang SK Hynix (SKHY.US) ay nagpasabog ng “malaking pagbili pabalik” na nagkakahalaga ng 40 trillion, habang sinabi ng JPMorgan na maaaring magbigay muli ng $130 billion “malaking regalo” sa 2027.

Matapos ipatupad ng SK hynix (SKHY.US) ang pinakabagong malakihang stock buyback plan nitong Miyerkules, sinabi ng JPMorgan na may malaking posibilidad na magdagdag ang kompanya ng hindi bababa sa 130 billions USD (tinatayang 180 trillions Korean won) bilang karagdagang gantimpala para sa mga shareholders bago magtapos ang susunod na taon.

智通财经2026/08/20 08:16
Ang SK Hynix (SKHY.US) ay nagpasabog ng “malaking pagbili pabalik” na nagkakahalaga ng 40 trillion, habang sinabi ng JPMorgan na maaaring magbigay muli ng $130 billion “malaking regalo” sa 2027.