熱門資訊> 正文
2026-08-19 18:50
智通財經APP獲悉,AI芯片公司Cerebras Systems(CBRS.US)在舊金山舉辦的SUPERNOVA發佈會上,正式推出了新一代機架級AI系統Cerebras CS-4,宣稱其為「業界最快的AI加速器」。該系統面向AI推理賽道,直接對標英偉達(NVDA.US)的GPU服務器產品。CS-4預計將於本季度(2026年第三季度)開始出貨,目前正由少數客户進行樣品測試。
技術規格:三顆晶圓級處理器鑄就750 PFLOPs算力
CS-4是Cerebras新一代Nexus機架級平臺架構的首款產品,由三顆全新的Wafer Scale Engine 3 Turbo(WSE-3T)晶圓級處理器驅動。WSE-3T是迄今為止規模最大的AI處理器,每顆芯片集成4萬億個晶體管和90萬個AI優化核心,覆蓋46,225平方毫米硅面積,內置44GB SRAM。
CS-4系統提供750 PFLOPs的AI算力、每秒129.6 PB的內存帶寬以及每秒7.2 Tbps的I/O吞吐量。與前代CS-3相比,CS-4速度提升兩倍,每瓦吞吐量提升10倍,顯著改善數據中心的經濟效益。與上一代WSE-3相比,WSE-3T將單顆晶圓的AI算力從125 PFLOPS翻倍至250 PFLOPS,內存帶寬從21.6 PB/s翻倍至43.2 PB/s。單顆芯片功耗也從15千瓦躍升至約33千瓦。
在架構設計上,CS-4採用模塊化的Nexus平臺架構,將計算、電源和I/O分離為獨立元件。電源轉換模塊從傳統GPU板上距處理器約50毫米的位置,縮短至約0.5毫米,幾乎消除了板級功耗損失。可插拔的「揹包式」設計將電源轉換、液冷和控制電子集成於一體,部署時間從數天縮短至數小時。
性能突破:GPT-OSS-120B測試中每用户每秒超4400 Token
Cerebras宣稱CS-4在推理速度方面樹立了新的行業標杆。在GPT-OSS-120B模型上的直接對比測試中,CS-4每用户每秒可生成超過4,400個Token,最高達到GPU方案的30倍。系統可支持超過50萬億參數的模型。
Cerebras首席技術官兼聯合創始人Sean Lie表示:「快30倍不只是讓響應感覺更流暢,它讓智能體系統在相同的實際時間內,擁有超過一個數量級的空間進行推理、驗證或工具調用」。Cerebras CEO Andrew Feldman則指出:「歷史上,快速推理意味着使用更小、能力更弱的模型。CS-4在最大的前沿模型上實現了業界領先的速度,從根本上改變了這一範式」。
在能效方面,CS-4每瓦吞吐量比CS-3提升最高10倍,顯著改善了數據中心的經濟效益。Cerebras CEO Andrew Feldman指出,由於快速Token比慢速Token更有價值,CS-4能夠在給定的功率預算內提供更高質量的Token和更多的Token總量,「從根本上改變了範式」。
CS-4還採用了組件數量減少50%的設計,使客户部署更簡便快捷。在系統架構上,新的Nexus平臺將計算、供電和I/O分離為模塊化元件——供電轉換從傳統GPU主板上距處理器約50毫米的位置,縮短至約0.5毫米,大幅降低了板級功耗並支持更高運行頻率。可插拔的「揹包」設計將供電轉換、液冷和控制電子集成在一個獨立單元中,將部署時間從數天縮短至數小時。
值得注意的是,Cerebras的晶圓級系統採用靜態隨機存取存儲器(SRAM),而非行業通用的DRAM。SRAM速度遠超DRAM,但體積更大、成本更高——Cerebras餐盤大小的晶圓提供了利用SRAM所需的物理空間。同時,單一芯片設計使數據傳輸距離遠短於英偉達或AMD的多芯片系統。
生態合作:與AMD Helios聯手,目標5倍效率提升
CS-4的可編程I/O子系統支持基於以太網的RoCE v2 RDMA標準,可與異構系統集成。Cerebras已與AMD(AMD.US) 就此架構展開合作,將AMD的Helios機架級解決方案與WSE搭配,每瓦每秒可產生的Token數量比純Cerebras配置高出5倍。AWS Trainium也被列為合作伙伴。
SemiAnalysis創始人兼CEO Dylan Patel評價稱,CS-4在可部署性和網絡能力上的提升,使其能擴展至更大規模的模型,打造「大規模Token工廠」。
市場背景:上市后股價較高點回落35%,CS-4成關鍵轉折點
Cerebras於2026年5月14日以每股185美元的價格在納斯達克上市,首日開盤價350美元,收盤報311.07美元,漲幅達68%。然而此后股價持續回落,周二報約220美元,較高點下跌約35%。
公司二季度財報喜憂參半:核心營收2.099億美元,同比增長103%;但每股虧損2.98美元,而去年同期為盈利1.91美元。公司對2027年核心營收增長三倍的指引以及超預期的Q3展望未能完全打動投資者。不過,公司剩余履約義務達254億美元,為未來收入提供了較強的能見度。
行業意義:AI推理市場格局面臨重塑
CS-4的發佈正值AI推理需求爆發式增長的關鍵節點。隨着大模型從訓練階段走向大規模部署,推理效率正成為AI基礎設施的核心競爭維度。Cerebras宣稱的30倍速度優勢若能在獨立基準測試中得到驗證,可能改變超大規模數據中心運營商的採購決策。
Cerebras CS-4的發佈,標誌着AI芯片競爭正從模型訓練向推理市場加速延伸。該系統能否真正撼動英偉達在AI推理領域的主導地位,將取決於其性能宣稱能否在獨立基準測試中得到驗證——以及CS-4能否以足夠的規模快速交付,以滿足超大規模數據中心運營商日益迫切的高速Token生成需求。
Cerebras的雲推理業務已在第二季度實現287%的同比增長,達到1.277億美元的核心雲收入。CS-4的推出標誌着Cerebras從銷售硬件向租賃推理能力的商業模式轉型進入新階段。