NVIDIA 的 Rubin GPU 架構,核心賣點是把下一代 AI 算力由單一 GPU,升級成一整套伺服器級平台。按公開資料同外媒整理,Rubin 會連同 Vera CPU、NVLink 6、ConnectX-9、BlueField-4 及 Spectrum-X 一齊構成 Vera Rubin AI 平台,目標是接棒 Blackwell,成為 2026 年下半年起的主力 AI 基礎設施。
從規格看,Rubin GPU 會採用雙晶粒設計,並轉用 HBM4 記憶體。單顆 GPU 預計提供約 50 PFLOPs 的 NVFP4 推理算力、288GB HBM4,以及約 22TB/s 記憶體頻寬。NVIDIA 亦聲稱,Rubin 在訓練效能上可較 Blackwell 提升約 3.5 倍,推理效能更可達到約 5 倍,同時 token 成本有望大幅下降。
Vera CPU 同樣是今次平台升級的關鍵。公開資料顯示,它採用全新 Olympus 核心架構,提供 88 核、176 線程,並與 Rubin GPU 透過 NVLink-C2C 進行高頻寬互連,方便處理代理式 AI 工作流中的資料預處理、調度同上下文管理。NVIDIA 今次不單止加速 GPU,而是把 CPU、GPU、網絡、儲存同伺服器級互連一併重設,明顯是針對大型模型訓練同推理中心的整體效率去設計。
整個 Vera Rubin NVL72 平台亦相當誇張,官方資料提到它由 72 顆 Rubin GPU 同 36 顆 Vera CPU 組成,並加入 NVLink 6 交換器、BlueField-4 DPU、Spectrum-X 網絡等元件,形成一個完整 AI 超級電腦架構。外媒形容,這不再是傳統意義上的「一塊更快顯示卡」,而是一套為 AI 工廠而生的完整算力堆疊。
時間表方面,NVIDIA 已表示 Rubin 平台會在 2026 年下半年開始交付,並於 2027 年再推 Rubin Ultra,進一步拉高封裝規模與記憶體配置。亦即是 Blackwell 仍會主導短期市場,但 Rubin 已經開始為下一輪 AI 伺服器、雲端推理同大模型訓練鋪路。














