AI 基礎設施/資料中心
AWS 接收首套 Vera CPU/Vera Rubin 系統,並規劃兩年增設 200 萬顆 NVIDIA GPU
AWS 已取得首套 Vera CPU 伺服器及 Vera Rubin GPU,兩家公司並計畫於 2027至2028年部署額外200萬顆 NVIDIA GPU。合作同時把 NVLink Fusion、NVHBM、Nitro 與 EFA 納入異質機架設計,但多數容量與效能仍屬未來承諾。

NVIDIA 於 8 月 27 日確認,AWS 已接收其首套 Vera CPU 伺服器與 Vera Rubin GPU。這是實體系統交付,不等於客戶已可建立相關 EC2 執行個體;目前較具體的商業規劃,是 AWS 預定在 2027至2028年間,於全球基礎設施及 AI factory 增設 200 萬顆 Blackwell Ultra、Rubin 與 Rubin Ultra GPU。這批數量是在先前逾 100 萬顆擴充計畫之外追加。
技術重點不只是 GPU 數量。AWS 準備引入獨立或與 Rubin 配套的 Vera CPU,讓代理工作負載中的工具執行、沙箱、資料管線及編排不必全部擠在加速器上。另一方面,Amazon 旗下 Annapurna Labs 將把 NVLink Fusion 與 NVIDIA 的 NVHBM 結合,使下一代 Trainium 和 NVIDIA GPU 可進入共同的機架級 scale-up 架構;跨機架仍以 AWS Nitro System、Elastic Fabric Adapter,以及雙方正在調校的 Spectrum 網路擴展。這意味 AWS 的自研晶片與 NVIDIA 平台可能共享更多記憶體、互連及管理層,而非維持完全分離的叢集。
兩家公司也公布鄰近資料管線的效能主張:RTX PRO 4500 驅動的 EC2 G7 推論效能為 G6 的 4.6 倍,EMR 配合 cuDF 最多加速 3.7 倍,OpenSearch 的 GPU 向量索引最多快 9 倍、成本降至四分之一。這些均是官方特定配置數字,尚未提供完整資料集、功耗、網路拓撲及等成本對照。工程團隊接下來應關注 Vera/Rubin 執行個體的正式上市時間、區域與配額、GPU 間互連比例、可預留容量和實際價格;在這些資料公布前,200 萬顆仍應視為多年部署計畫,而非可立即排程的算力。