在 Dell Technologies World 主題演講上,戴爾與 NVIDIA 公布了對企業級 AI 基礎設施的大幅擴充。全新 AI 伺服器「Dell PowerEdge XE9812」以 NVIDIA 新架構「Vera Rubin NVL72」打造,據稱與上一代 Blackwell 相比,可將單位 token 成本最多降低至十分之一。這些發布反映出生成式 AI 正越過試行階段,邁向大規模運行自主「代理式 AI(agentic AI)」的新階段[1]。
企業 AI 需求邁入「實用 AI」時代
在主題演講中,戴爾董事長兼執行長 Michael Dell 預測,到 2030 年全球 AI 基礎設施支出可能達到 3 兆至 4 兆美元(約 480 兆至 640 兆日圓),同期 token 消耗量可能成長多達 3,400 個百分點[1]。※1 美元 = 159 日圓(截至 2026 年 5 月 29 日)
登台的 NVIDIA 創辦人兼執行長黃仁勳表示,需求之所以快速擴大,是因為「我們已邁入實用 AI 的時代」。過去需要數月的工作如今只需數週,過去需要數週的工作如今只需數天,生產力的提升也伴隨著所需運算量的大幅躍升[1]。
目前,禮來、三星、Honeywell 等 5,000 家企業已在與 NVIDIA 合作的「Dell AI Factory」上以正式環境運行 AI 工作負載,顯示企業 AI 應用正從概念驗證走向全面落地[1]。
搭載 Vera Rubin 的全新伺服器群壓縮單位 token 成本
本次發布的核心是面向加速運算的伺服器更新。作為旗艦的 Dell PowerEdge XE9812 以 Vera Rubin NVL72 為基礎,據稱在大規模代理式 AI 推論中,相較 Blackwell 可將單位 token 成本最多降低至十分之一[1]。
與之搭配的,是作為戴爾首批以 NVIDIA HGX Rubin NVL8 打造之系統的「PowerEdge XE9880L」「XE9885L」與「XE9882L」。它們每機櫃最多支援 144 張 GPU,採用 100% 直接液冷的運算節點,目標是達到 HGX B200 最高 10 倍的效能[1]。
在網路方面,搭載 NVIDIA Quantum-X800 InfiniBand 的全新「Dell PowerSwitch」系列,與 NVIDIA Spectrum-6 乙太網路一同推出。戴爾還推出將運算、網路與儲存一體化設計的整合系統「Dell PowerRack」,省去逐一組裝零件的繁瑣[1]。
Vera CPU 與資料平台的更新
在 CPU 方面,搭載 NVIDIA 新款「Vera」CPU 的「Dell PowerEdge M9822」與「R9822」伺服器加入企業 AI 工廠。Vera 專為資料管線、分析等代理式 AI 的循序處理而設計,具備 1.2 TB/s 的記憶體頻寬,據稱完成代理式工作負載的速度比 x86 處理器快 50%[1]。
黃仁勳稱「Vera CPU 擁有全球任何 CPU 中最高的單執行緒效能」,並指出其 3 倍的記憶體頻寬可帶來更快的資料庫處理。加入 Dell AI Data Platform 的全新資料引擎「Starburst」,據稱在 Vera CPU 上可將大規模 SQL 分析的查詢吞吐量提升至 3 倍[1]。
在本地安全守護的前沿模型與 AI 代理
戴爾在主題演講上引用的自家調查顯示,目前 67% 的 AI 工作負載運行在雲端之外(地端、裝置端、邊緣或主機代管),且 88% 的受訪者至少有一項 AI 工作負載運行於地端[1]。
被定位為滿足此需求關鍵的,是在保護敏感資料與模型的同時進行處理的「NVIDIA Confidential Computing」。它與 Fortanix、Google、Red Hat 等夥伴合作,目標是在不暴露模型智慧財產或資料的前提下,讓企業在自有邊界內安全運行前沿模型[1]。
具體而言,整合 Gemini 3.0 的 Google Distributed Cloud 將在搭載 NVIDIA Blackwell 的「PowerEdge XE9780」上以預覽形式提供;NVIDIA Nemotron 等開放模型則在 Dell AI Factory 上運行。在代理方面,OpenAI 的程式設計助手「Codex」將與 Dell AI Data Platform 介接,並計畫將其與內部程式碼庫和業務系統相連[1]。
在貼近個人工作環境的領域,採用 NVIDIA Grace Blackwell 架構的「Dell Pro Max with GB10/GB300」上,可運行使用 NVIDIA Nemotron 開放模型的桌邊代理式 AI。支撐這些的,是用於建構代理的 NVIDIA Nemotron、代理編排,以及負責安全的開源執行環境,它們在整個 Dell AI Factory 中提供[1]。
總結
本次發布顯示,企業 AI 應用正從概念驗證邁向正式部署,進入可在地端安全且大規模運行自主代理式 AI 的階段。Vera Rubin 伺服器帶來的單位 token 成本壓縮、Vera CPU 與資料平台的更新,以及守護敏感資料的機制被作為一套整體方案呈現。Dell Technologies World 第二天及之後安排了更深入的講解,相關話題也將延續至 6 月 1 日至 4 日舉行的 GTC Taipei at COMPUTEX。
出典:https://blogs.nvidia.com/blog/dell-technologies-agent-enterprise-ai
