劍指英偉達!Cerebras(CBRS.US)發布「最快AI加速器」CS-4系統,宣稱推理速度達GPU方案30倍
Cerebras推出CS-4系統,並稱其為業界速度最快的AI加速器。
智通財經APP獲悉,AI晶片公司Cerebras Systems(CBRS.US)於舊金山舉辦的SUPERNOVA發表會上,正式推出新一代機架級AI系統Cerebras CS-4,宣稱其為「業界最快的AI加速器」。該系統面向AI推理賽道,直接對標Nvidia(NVDA.US)的GPU伺服器產品。CS-4預計將於本季(2026年第三季)開始出貨,目前正由少數客戶進行樣品測試。
技術規格:三顆晶圓級處理器打造750 PFLOPs算力
CS-4是Cerebras新一代Nexus機架級平台架構的首款產品,由三顆全新的Wafer Scale Engine 3 Turbo(WSE-3T)晶圓級處理器驅動。WSE-3T是迄今為止規模最大的AI處理器,每顆晶片集成4兆顆電晶體和90萬個AI優化核心,覆蓋46,225平方毫米矽面積,內建44GB SRAM。
CS-4系統提供750 PFLOPs的AI算力、每秒129.6 PB的記憶體頻寬以及每秒7.2 Tbps的I/O吞吐量。與前代CS-3相比,CS-4速度提升兩倍,每瓦吞吐量提升10倍,顯著改善資料中心的經濟效益。與上一代WSE-3相比,WSE-3T將單顆晶圓的AI算力從125 PFLOPs倍增至250 PFLOPs,記憶體頻寬從21.6 PB/s倍增至43.2 PB/s。單顆晶片功耗也由15千瓦提升至約33千瓦。
在架構設計上,CS-4採用模組化的Nexus平台架構,將計算、電源和I/O分離為獨立元件。電源轉換模組從傳統GPU板上距處理器約50毫米的位置,縮短至約0.5毫米,幾乎消除板級功耗損失。可插拔的「背包式」設計將電源轉換、液冷與控制電子集成於一體,部署時間由數天縮短至數小時。
效能突破:GPT-OSS-120B測試中每用戶每秒超過4400 Token
Cerebras宣稱CS-4在推理速度方面樹立了新的行業標竿。在GPT-OSS-120B模型上的直接對比測試中,CS-4每用戶每秒可產生超過4,400個Token,最高達GPU方案的30倍。系統可支援超過50兆參數的模型。
Cerebras首席技術官及聯合創辦人Sean Lie表示:「快30倍不只是讓回應感覺更流暢,它讓智能體系統在相同的實際時間內,擁有超過一個數量級的空間進行推理、驗證或工具調用。」Cerebras CEO Andrew Feldman則指出:「歷史上,快速推理意味著使用更小、能力更弱的模型。CS-4在最大前沿模型上實現了業界領先的速度,從根本上改變了這一範式。」
在能效方面,CS-4每瓦吞吐量比CS-3提升最多10倍,顯著改善了資料中心的經濟效益。Cerebras CEO Andrew Feldman指出,由於快速Token比慢速Token更有價值,CS-4能在給定的功率預算內提供更高品質的Token和更多的Token總量,「從根本上改變了範式」。
CS-4還採用了元件數量減半的設計,使客戶部署更簡單快捷。在系統架構上,新的Nexus平台將計算、供電與I/O分離成模組化元件——供電轉換從傳統GPU主板上距處理器約50毫米的位置,縮短至約0.5毫米,大幅降低了板級功耗並支援更高運作頻率。可插拔的「背包」設計將供電轉換、液冷與控制電子集成於一個獨立單元,將部署時間由數天縮短至數小時。
值得注意的是,Cerebras的晶圓級系統採用靜態隨機存取記憶體(SRAM),而非業界通用的DRAM。SRAM速度遠超DRAM,但體積更大、成本較高——Cerebras餐盤大小的晶圓提供了使用SRAM所需的物理空間。同時,單一晶片設計使資料傳輸距離遠短於Nvidia或AMD的多晶片系統。
生態合作:與AMD Helios聯手,目標5倍效率提升
CS-4的可程式化I/O子系統支援基於乙太網的RoCE v2 RDMA標準,可與異質系統整合。Cerebras已與AMD(AMD.US)就此架構展開合作,將AMD的Helios機架級解決方案與WSE搭配,每瓦每秒可產生的Token數量比純Cerebras配置高出5倍。AWS Trainium亦被列為合作夥伴。
SemiAnalysis創辦人兼CEO Dylan Patel評價指出,CS-4在可部署性和網路能力上的提升,使其能擴展至更大規模的模型,打造「大規模Token工廠」。
市場背景:上市後股價較高點回落35%,CS-4成為關鍵轉折點
Cerebras於2026年5月14日以每股185美元於納斯達克上市,首日開盤價350美元,收盤報311.07美元,漲幅達68%。然而此後股價持續回落,週二報約220美元,較高點下跌約35%。
公司第二季財報喜憂參半:核心營收2.099億美元,同比增長103%;但每股虧損2.98美元,而去年同期為盈利1.91美元。公司對2027年核心營收成長三倍的指引以及超預期的Q3展望未能完全打動投資者。不過,公司剩餘履約義務達254億美元,為未來收入提供了較強的能見度。
行業意義:AI推理市場格局面臨重塑
CS-4的發表正值AI推理需求爆發性增長的關鍵節點。隨著大型模型從訓練階段走向大規模部署,推理效率正成為AI基礎設施的核心競爭面向。Cerebras宣稱的30倍速度優勢若能在獨立基準測試中獲得驗證,可能改變超大規模資料中心營運商的採購決策。
Cerebras CS-4的發表,標誌著AI晶片競爭正由模型訓練向推理市場加速延伸。該系統能否真正撼動Nvidia於AI推理領域的主導地位,將取決於其性能宣稱能否於獨立基準測試中獲得驗證——以及CS-4能否以足夠規模快速交付,以滿足超大規模資料中心營運商日益迫切的高速Token生成需求。
Cerebras的雲推理業務已於第二季實現287%同比增長,達到1.277億美元的核心雲收入。CS-4的推出標誌著Cerebras由銷售硬體向租賃推理能力的商業模式轉型進入新階段。
免責聲明:文章中的所有內容僅代表作者的觀點,與本平台無關。用戶不應以本文作為投資決策的參考。
您也可能喜歡
新CEO「扭虧戰略」持續見效!塔吉特(TGT.US)Q2營收超預期、關稅退款助利潤飆升,全年指引再度上調
隨著新任CEO菲德爾克扭轉頹勢的舉措初見成效,Target再次上調年度業績預期。


金山雲Q2營收同比增長30.8%創歷史新高,AI驅動盈利能力顯著改善|財報見聞

關於Robotaxi規模化部署和Optimus機器人上市節奏,這是摩根大通特斯拉工廠的最新調查
Robotaxi車隊擴張將在2026年底至2027年初迎來明顯加速,擴張的關鍵觸發點已明確鎖定在FSD v15於年內推出。Optimus方面,Gen 3設計已完成定稿,供應鏈已基本鎖定,量產啟動(SoP)後初步部署目標為2026年下半年進入「Optimus Academy」訓練階段,最快於2027年下半年實現對外商業銷售。
