Cerebras 推出 CS‑4 機架級 AI 加速器,宣稱業界最快
綜合科技

Cerebras 推出 CS‑4 機架級 AI 加速器,宣稱業界最快

AI News Bot
2026-08-25
預計閱讀 1 分鐘原文來源

核心亮點

Cerebras 今日正式發表 CS‑4 機架級 AI 加速器,公司執行長 Andrew Feldman 直言此系統是「業界最快」的 AI 計算平台。CS‑4 以完整的伺服器機櫃形式提供,內含算力單元、電力與散熱系統,一體化部署於資料中心。

技術細節與效能提升

  • 晶片平台:仍採用 5 奈米製程的 WSE‑3 晶圓(Wafer‑Scale Engine),但透過提升時脈、加大供電與改良散熱,使效能較前代 CS‑3 翻倍。
  • 機架配置:單一機架內可安裝 三片晶圓,取代以往的兩片配置。每片晶圓保有 44 GB 記憶體容量,未因效能提升而犧牲儲存空間。
  • 推理效能:在每位使用者的情境下,CS‑4 可達 每秒 4,400 個 token 的處理速度,Cerebras 宣稱相較於傳統 Nvidia GPU 設置快 30 倍。
  • 模組化設計:全新 「Backpack」 模組化機構縮短組裝時間,提升維運彈性。
  • 分散式推理:透過與 AMD 及 AWS Trainium 等合作夥伴的整合,實現算力的解耦與彈性調度。

市場與產業影響

分析師 SemiAnalysis 指出,CS‑4 在網路互連(networking)方面的提升相對有限,主要效益仍集中於晶圓本身的算力與散熱效率。儘管如此,Cerebras 已被 OpenAI 用於 Codex Spark 等大型語言模型的推理工作,顯示其在高階 AI 工作負載中的實際應用價值。若其聲稱的 30 倍效能差距屬實,將對以 GPU 為主的 AI 基礎建設產生顯著衝擊,特別是在需要極速 token 輸出的生成式模型領域。

未來展望

CS‑4 的詳細規格與實測數據將於 Hot Chips 大會進一步揭露。若其模組化與分散式架構能在大規模部署中證明可靠,未來可能成為資料中心升級的首選方案,亦有望推動 AI 加速器市場從「GPU 為王」向「晶圓級別」多元化競爭轉變。對於關注 AI 計算成本與效能的企業而言,持續追蹤 Cerebras 的技術路線圖與生態系整合進度,將是制定長期投資與架構規劃的關鍵。

分享