NVIDIA 在台灣舉辦的「GTC Taipei」主題演講上宣布,針對 AI 資料中心、由全新 CPU 與 GPU 組合而成的平台「Vera Rubin」已進入全面量產。同時,公司也公開了把整座 AI 資料中心的設計打包在一起的「NVIDIA DSX AI Factory Platform」。從伺服器、機架進一步走向「整棟設施」層級的方案,可以看出 NVIDIA 想要改變 AI 基礎設施本身建置方式的企圖。

「Vera Rubin」是什麼

這次發表由執行長黃仁勳在台北流行音樂中心的主題演講中揭曉。近年來 NVIDIA 常常藉由配合 COMPUTEX 的台北演講發布資料中心 AI 的重要消息,今年也沿用了同樣的舞台。

Vera Rubin 是 2024 年在 COMPUTEX 上首次發表的平台,把針對 AI 工廠(專為 AI 處理而建的資料中心)的次世代 CPU「Vera」與 GPU「Rubin」組合在一起。黃仁勳透露 Vera Rubin 已開始全面量產,並表示面向出貨的準備正按計畫推進。開發中的產品進入量產階段,代表它距離真正開始交付到全球資料中心的時間點已經不遠。

主打「低延遲」的 Vera CPU

黃仁勳在演講中花最多時間說明的,是自家研發的 CPU「Vera」。

傳統 CPU 一直沿著增加核心數量、以並行處理任務的方向演進。相較之下,Vera 採用重視低延遲(也就是資料往來所需等待時間更短)的設計。其基礎是 NVIDIA 自行研發的「Olympus Core」,黃仁勳強調這項設計最適合 AI 推論(也就是訓練完成的 AI 實際給出答案的處理環節)。

他以效能比較來說明這項優勢。與 x86 處理器相比,資料庫操作所用的 SQL 處理約快 3 倍,即時串流資料的處理約快 6 倍。其邏輯在於,隨著在 CPU 與 GPU 之間自主往返、自主性更高的 AI 代理越來越多,這種低延遲設計的價值也會愈發突出。

為整座資料中心做設計的「DSX」

另一大亮點是 NVIDIA DSX AI Factory Platform。

如今在全球各地興建的 AI 工廠,是專為 AI 訓練與推論而生的新型資料中心,所需的設計與傳統資料中心有很大不同。視規模而定,它可能需要吉瓦級的電力,除了 800V 的 DC(直流)供電,還必須仰賴電池與電容來確保穩定供電。而且由於其散熱設計以液冷為前提,還需要連同水路一併細緻設計。

DSX 正是把這些從 AI 工廠設計手法到所需材料採購方式在內的專業知識打包提供的機制。NVIDIA 一路擴大自己的提供範圍:從伺服器「DGX」起步,再到展示機架級設計的「GB200/300 NVL72」與「Vera Rubin NVL72」(一種把 72 顆 Rubin GPU 與 36 顆 Vera CPU 綑綁在一起的配置),如今又透過 DSX 深入到資料中心本身的設計。

由台灣支撐的供應鏈

根據 NVIDIA 表示,Dell Technologies、HPE、Lenovo、Supermicro、ASUS、Foxconn、GIGABYTE、Pegatron、Quanta Cloud Technology (QCT)、Wistron、Wiwynn 等廠商計畫採用 DSX 與 Vera Rubin,為客戶提供 AI 工廠。名單上的這些名字,是以台灣為中心的伺服器製造主力企業,凸顯出把 NVIDIA 新平台真正做成實體產品的供應鏈之厚實。

在台北發表的意義也不容忽視。去年在同一個台北舞台上,NVIDIA 發表了透過 NVLink 連接不同晶片的「NVLink Fusion」,其後促成了與 Intel 的合作。資料中心 AI 的節點在台北揭曉,這一脈絡今年依然延續。

總結

NVIDIA 宣布了由 CPU 與 GPU 組合而成的 Vera Rubin 開始量產,以及為整座資料中心做設計的 DSX AI Factory Platform。針對 AI 推論最佳化的 Vera CPU、涵蓋整棟設施的設計知識,以及以台灣企業為中心的供應鏈,這三大要素到位,把 AI 基礎設施不再當作「零件」而是當作「一整套」交付的體系正在成形。這項著眼於 AI 代理普及的舉措,將在多大程度上加速未來資料中心的建置,值得持續關注。