AWS 與英偉達擴大合作,新增 200 萬顆 GPU 與 Vera CPU 基礎建設
綜合科技

AWS 與英偉達擴大合作,新增 200 萬顆 GPU 與 Vera CPU 基礎建設

AI News Bot
2026-08-28
Photo by Nana Dua on Pexels
預計閱讀 1 分鐘原文來源

AWS 與 NVIDIA 擴大合作 新增 200 萬顆 GPU 與 Vera CPU 基礎建設

AWS 與 NVIDIA 昨日宣布,將在兩家公司已持續 16 年的合作基礎上,額外部署 200 萬顆 NVIDIA GPU,同時把 Vera CPU(NVIDIA 首款客製化 CPU)與 Vera Rubin GPU 帶入 AWS 雲端平台。這是 Vera 系列自 2026 年 5 月首次在 Oracle Cloud Infrastructure、Anthropic、OpenAI 與 SpaceXAI 等領先 AI 研究機構部署後,首次亮相於 AWS。

背景與技術重點

  • 代理式 AI(Agentic AI):指 AI 不僅回答問題,還能執行指令、協調多項任務的能力。此類工作對 CPU 的即時運算需求遠高於傳統 GPU 計算。
  • Vera CPU 的設計:內建 88 顆 NVIDIA 設計的 Olympus 核心,記憶體頻寬達 1.2 TB/s,在代理式 AI 工作負載上每核心效能提升 最高 1.8 倍。此效能提升可縮短任務完成時間,提升整個 AI 生產線的效率。
  • Vera Rubin GPU:作為配套的圖形處理單元,與 Vera CPU 共同支援從資料前處理到長上下文檢索的全流程運算。

NVIDIA 超大規模與高效能運算(HPC)副總裁 Ian Buck 親自將首批 Vera CPU 伺服器與 Vera Rubin GPU 送至西雅圖的 AWS 總部,交由 Amazon EC2 副總裁 Willem Visser 及 硬體工程副總裁 Supreeth Sheshadri。Buck 表示:「代理式 AI 正在 AI 工廠內創造全新 CPU 時代,Vera 正是為此而生,讓工作以十倍速度前進。」

產業影響

  1. 雲端算力升級:200 萬顆 GPU 的擴增將使 AWS 在生成式 AI、機器學習訓練與推論市場的算力供應更為充足。

  2. CPU 與 GPU 協同:Vera 的高頻寬與多核心設計,使得 AI 代理在執行長上下文檢索、工具呼叫與即時協調時不再受 CPU 瓶頸限制。

  3. 客戶效益:對於需要大量 token 處理、快速回應的企業應用(如自動化報告、即時模擬),Vera 可在相同成本下提供更多算力,提升每美元的 token 效率。

未來展望

隨著 AWS 將 Vera 系列納入其 EC2 服務,預計未來會有更多 AI 代理應用在雲端部署,從資料分析到自動化決策皆可受惠於更快的 CPU 迴圈與 GPU 加速。對於希望在 AI 時代保持競爭力的企業而言,掌握 CPU 與 GPU 協同效能 將成為關鍵成功因素。

結語:AWS 與 NVIDIA 的深化合作不僅是硬體規模的擴張,更象徵 AI 基礎建設從「GPU 為王」向「CPU 與 GPU 共舞」的轉型。企業若能及早採用 Vera 平台,將在新一波代理式 AI 浪潮中取得先機。

分享