創造與建構
挑战GPU、绕过HBM,深挖史上最大芯片背后的Cerebras
摘要
完整回顧晶片新創 Cerebras 從 2016 年成立到 2026 年 5 月上市(市值一度近千億美元)的十年歷程:五位工程師押注晶圓級引擎這個當時被視為瘋狂的架構,把整片晶圓做成單一巨大 AI 處理器,用縮小核心與冗餘路由解決良率難題;歷經三年隱身燒錢、政府實驗室早期客戶、G42 合約引發 CFIUS 國安審查而撤回首次 IPO,最終在 AI 從訓練轉向推理的浪潮中,靠內存帶寬優勢與 OpenAI、AWS 等簽下總值超過 200 億美元的推理合約而成功上市。內容為繁體中文頻道原生內容,僅做用語校對。
重點
- Cerebras 由五位前 SeaMicro/AMD 工程師於 2016 年創立,核心賭注是把整片晶圆做成單一 AI 處理器(晶圓級引擎),面積是最大 GPU 的 58 倍,計算單元與內存同片,內存帶寬達 GPU 的數千倍量級
- 良率解法:把核心縮小到 H100 核心的約 1%(0.05 平方毫米),加上約 1%到1.5% 的備用核心與可動態重配置的片上網路,讓 46 個晶圓缺陷被自動繞開、對軟體呈現完美無缺的晶片
- 2016到2019 每月燒錢約 800 萬美元、連續三年沒有產品沒有客戶,2019 年 WSE-1 量產成功,早期客戶是阿貢國家實驗室、勞倫斯利福摩爾國家實驗室等政府單位
- G42(阿布達比 AI 集團)合約一度佔 Cerebras 營收 87%,2024 年觸發 CFIUS 國安審查導致首次 S-1 撤回,2025 年 3 月審查放行後於 2026 年 5 月正式上市,首日收盤上漲 68%、市值一度觸及千億美元
- 2025 年底同一天發生兩件大事:英偉達以 200 億美元收購授權 Groq 資產;OpenAI 與 Cerebras 簽署同樣超過 200 億美元的推理算力合約(承諾部署 750 兆瓦、可擴至 2030 年 2 吉瓦),是史上最大 AI 推理部署合約
- 推理時代對 Cerebras 更有利:解碼階段是嚴格串行過程,內存帶寬成為關鍵瓶頸,Cerebras 推理速度可達每秒超過 2000 個 token(傳統方案約 200到300),並避開了 HBM、CoWoS 封裝、3 奈米製程等當前最緊張的供應鏈瓶頸
金句
當別人說「這個問題解決不了」的時候,你心裡想的是「你」解決不了。
我們解決了計算機行業裡最難的問題之一,但沒有人在乎。