AI News HubLIVE
站內改寫2 分鐘閱讀

Cerebras十多年前豪賭餐盤大小的AI加速器,如今市值660億美元

Cerebras Systems憑藉其餐盤大小的晶圓級AI加速器,在2026年5月15日的IPO中籌集了55.5億美元,市值超過660億美元。該公司從2015年成立以來,經歷了多次技術迭代,從WSE到WSE-3,並在推理領域取得了重大突破。儘管面臨競爭,Cerebras的未來計劃包括推出WSE-4晶片和深化與AWS等公司的合作。

來源Hacker News AI作者: beardyw

Cerebras Systems憑藉其餐盤大小的晶圓級AI加速器,在2026年5月15日的IPO中大獲成功,籌集了55.5億美元,首日市值超過660億美元。這家長期與Nvidia競爭的公司,從2015年由前SeaMicro負責人Andrew Feldman創立以來,走過了一條非傳統的晶片製造之路。

Cerebras的核心創新在於其晶圓級引擎(WSE),一塊麵積達46,225平方毫米的巨型晶片。與傳統的將晶圓切割成小晶片再重新連線的GPU不同,Cerebras直接在整塊晶圓上蝕刻計算單元。這種設計不僅提高了計算密度,還透過硬體稀疏性支援加速深度學習中的矩陣運算。例如,第一代WSE在16位精度下可實現2.65 petaFLOPS的密集計算,而透過稀疏性,有效計算輸出可提升至26.5 petaFLOPS。Nvidia在一年後也加入了稀疏性支援,但僅限於2:4的比例,限制了其適用範圍。

WSE晶片依賴片上SRAM,而非HBM或GDDR記憶體。雖然SRAM提供極高的頻寬(第一代可達9 PB/s),但容量有限,第一代僅有18 GB,而同期Nvidia GPU已配備32 GB。這一限制促使Cerebras在後續版本中不斷最佳化。2021年,第二代WSE-2採用臺積電7nm工藝,電晶體數、計算密度、SRAM容量和頻寬均翻倍。2024年推出的WSE-3基於5nm工藝,計算能力進一步翻倍至125 petaFLOPS稀疏計算(12.5 petaFLOPS密集),SRAM容量增至44 GB。

Cerebras的客戶主要來自雲服務領域,尤其是阿聯酋的G42,該公司在2023年訂購了價值9億美元的九個超算站點。2024年中,Cerebras推出推理即服務,意外發現其晶片在LLM推理方面表現卓越。其WSE-3晶片的SRAM頻寬高達21 PB/s,幾乎是Nvidia最新Rubin GPU的1000倍,結合推測解碼技術,可生成超2200 tokens/秒(執行GPT-OSS 120B High時),速度是第二名Fireworks的2.8倍。這一能力吸引了Alphasense、AWS、Cognition、Meta、Mistral AI、Notion、Perplexity以及後來的OpenAI等客戶。

最初,Cerebras在2024年9月提交S-1檔案尋求上市,但因G42貢獻了87%的收入,公司於2025年9月撤回檔案。隨著推理業務增長和客戶多元化,它於2026年5月成功上市,股票首日漲幅近70%。

展望未來,Cerebras面臨技術更新壓力。WSE-3已顯老態,Nvidia透過收購Groq獲得了自己的SRAM推理平臺。預計下一代WSE-4將在浮點效能上大躍升,可能支援FP8和FP4精度,並有望透過臺積電3D晶片堆疊技術增加SRAM容量。此外,Cerebras計劃深化與AWS等公司的合作,可能將其晶片作為解碼加速器,與其他廠商的晶片協同工作。總之,這家以大膽晶圓級設計聞名的公司,正站在新的增長起點上。