NVIDIA 宣布正在加速面向 AI 運算需求的雲端基礎設施「NVIDIA AI 雲」的全球部署。隨著非洲的 Cassava 與南美的 Claro 加入,其涵蓋範圍已擴展至六大洲。CoreWeave、Nebius 等眾多合作夥伴正在擴建 AI 工廠(面向 AI 的大規模運算基礎設施),以支撐代理型 AI 的擴張。
涵蓋六大洲的「NVIDIA AI 雲」
NVIDIA AI 雲是一組專用雲端的集合,用於滿足當今主流 AI 應用背後激增的 token(AI 處理時的生產單位)需求[1]。它與 NVIDIA 的全端 AI 基礎設施一體化設計,可滿足企業、新創公司以及各國政府等的需求[1]。透過將加速運算、網路與 AI 軟體相結合,它能夠支援訓練、微調、推論、代理型 AI、實體 AI 以及主權 AI(各國在本國境內自主管理的 AI 基礎設施)等廣泛用途[1]。
此次隨著非洲的 Cassava 與南美的 Claro 加入,NVIDIA AI 雲的涵蓋範圍達到了六大洲[1]。在東南亞、澳洲以及南北美洲,區域部署正在加速[1]。
NVIDIA 創辦人暨執行長黃仁勳表示:「每一家企業、每一個國家都需要 AI 工廠基礎設施,以將資料轉化為智慧。」他藉此強調在貼近各區域與各產業之處,支撐從模型訓練到即時推論乃至 AI 代理的目標[1]。
支撐區域與主權 AI 的多元合作夥伴
AI 雲服務商、電信業者、主權 AI 建置方以及垂直整合型基礎設施供應商等,正與 NVIDIA 攜手建置 AI 工廠[1]。
CoreWeave、Firmus、IREN、Nscale 等合作夥伴,正面向前沿模型(最先進的大規模 AI 模型)開發、企業級 AI、代理型應用以及高吞吐推論擴建基礎設施[1]。此外,Firebird、GMI Cloud、Indosat Ooredoo Hutchison、Lambda、Naver Cloud、Sharon AI、Yotta 與 YTL 則在支撐新興 AI 企業、各國 AI 計畫,以及金融、電信、製造、教育、醫療和開發者生態[1]。針對受監管產業與政府,NVIDIA 強調,區域性 AI 雲能夠滿足主權管控與當地法遵要求[1]。
Firmus、CoreWeave 與 Nebius 的擴張
Firmus Technologies 透過「Project Southgate」,在澳洲的塔斯馬尼亞、墨爾本、南澳洲與新南威爾斯州部署 AI 工廠,並重視再生能源、先進散熱以及可快速上線的模組化基礎設施[1]。在新加坡,它已與 ST Telemedia Global Data Centres 合作完成部署[1]。其液冷系統 Firmus HyperCube 依據 NVIDIA DSX 設計,旨在於壓低單位 token 成本的同時,加快模組化 AI 工廠的建置[1]。
CoreWeave 正面向代理型 AI、實體 AI 與前沿模型處理擴建基礎設施[1]。作為 NVIDIA Vera Rubin 架構與 NVIDIA Vera CPU 的早期採用者,它還率先部署了 NVIDIA Spectrum-X Ethernet Photonics,為百萬級 GPU 規模的 AI 工廠建立網路基礎[1]。在機器人領域,它採用最新的世界基礎模型 NVIDIA Cosmos 3,而 Anthropic 等 AI 實驗室正在 CoreWeave 的基礎設施上運行大規模前沿模型[1]。
Nebius 正打造面向訓練、推論與實體 AI 開發的全端基礎設施[1]。它同樣早期採用了 Vera Rubin,並將自有的 Nebius AI Cloud、推論層 Token Factory 與全新的 Physical AI Workbench 結合在一起[1]。該工作台將 Cosmos 3、NVIDIA Isaac Sim 與 Isaac GR00T 作為可組合的工作流程提供,協助團隊更快地從模擬與合成資料邁向訓練與評估[1]。
「Exemplar Cloud」與 token 經濟性
在 NVIDIA 去年推出的「Exemplar Cloud」認證中,迄今已有 CoreWeave、Crusoe、Lambda、Nebius、Vultr 與 YTL 這 6 家取得該認證[1]。NVIDIA 表示,這反映出市場對能夠在正式環境中提供穩定效能、可靠性與高效率的雲端的需求正在上升[1]。
NVIDIA 指出,隨著 AI 從開發階段轉向推論與高吞吐推論處理,衡量基礎設施的標準正從「已宣布的容量」轉向「token 輸出的經濟性」[1]。單位 token 成本是一項涵蓋硬體效能、軟體最佳化與實際使用率的總持有成本(TCO)指標,NVIDIA 聲稱自身實現了業界最低的單位 token 成本[1]。
加快上線的 NVIDIA DSX
NVIDIA AI 雲開始採用 NVIDIA DSX 平台來設計、建置與營運 AI 工廠[1]。DSX 匯集經過驗證的參考設計、模擬與軟體,協助更快地讓產能上線並更有效率地營運[1]。
具體而言,包括在部署前對 AI 工廠進行驗證的 DSX Sim、依電網狀況動態調整負載的 DSX Flex、在有限電力預算內最大化運算並可多運行最多 40% GPU 的 DSX MaxLPS,以及實現大規模營運自動化的 DSX OS[1]。NVIDIA 表示,這些元件可降低部署風險、提升每瓦 token 產出,並力求實現最低的單位 token 成本[1]。
總結
NVIDIA 推出了隨 Cassava 與 Claro 加入而擴展至六大洲的 AI 雲生態,以及由 CoreWeave、Firmus、Nebius 等合作夥伴擴建的 AI 工廠[1]。透過將以單位 token 成本為核心的經濟性,與加快建置的 NVIDIA DSX 相結合,該公司正著力加速面向代理型 AI 普及的區域與主權 AI 基礎設施建置[1]。
