在 Dell Technologies World 主题演讲上,戴尔与英伟达公布了对企业级 AI 基础设施的大幅扩充。全新 AI 服务器"Dell PowerEdge XE9812"基于英伟达新架构"Vera Rubin NVL72"打造,据称与上一代 Blackwell 相比,可将单位 token 成本最多降低至十分之一。这些发布反映出生成式 AI 正越过试点阶段,迈向大规模运行自主"代理式 AI(agentic AI)"的新阶段[1]

企业 AI 需求进入"实用 AI"时代

在主题演讲中,戴尔董事长兼首席执行官 Michael Dell 预测,到 2030 年全球 AI 基础设施支出可能达到 3 万亿至 4 万亿美元(约 480 万亿至 640 万亿日元),同期 token 消耗量可能增长多达 3,400 个百分点[1]※1 美元 = 159 日元(截至 2026 年 5 月 29 日)

登台的英伟达创始人兼首席执行官黄仁勋表示,需求之所以快速扩大,是因为"我们已进入实用 AI 的时代"。过去需要数月的工作如今只需数周,过去需要数周的工作如今只需数天,生产力的提升也伴随着所需算力的大幅跃升[1]

目前,礼来、三星、霍尼韦尔等 5,000 家企业已在与英伟达合作的"Dell AI Factory"上以生产环境运行 AI 工作负载,显示出企业 AI 应用正从概念验证走向全面落地[1]

搭载 Vera Rubin 的全新服务器群压缩单位 token 成本

本次发布的核心是面向加速计算的服务器更新。作为旗舰的 Dell PowerEdge XE9812 基于 Vera Rubin NVL72,据称在大规模代理式 AI 推理中,相比 Blackwell 可将单位 token 成本最多降低至十分之一[1]

与之搭配的,是作为戴尔首批基于英伟达 HGX Rubin NVL8 系统的"PowerEdge XE9880L""XE9885L"和"XE9882L"。它们每机架最多支持 144 块 GPU,采用 100% 直接液冷的计算节点,目标是达到 HGX B200 最高 10 倍的性能[1]

在网络方面,搭载英伟达 Quantum-X800 InfiniBand 的全新"Dell PowerSwitch"系列,与英伟达 Spectrum-6 以太网一同推出。戴尔还推出了将计算、网络与存储一体化设计的整合系统"Dell PowerRack",省去逐一组装部件的繁琐[1]

Vera CPU 与数据平台的更新

在 CPU 方面,搭载英伟达新款"Vera"CPU 的"Dell PowerEdge M9822"和"R9822"服务器加入企业 AI 工厂。Vera 专为数据管线、分析等代理式 AI 的串行处理而设计,具备 1.2 TB/s 的内存带宽,据称完成代理式工作负载的速度比 x86 处理器快 50%[1]

黄仁勋称"Vera CPU 拥有全球任何 CPU 中最高的单线程性能",并指出其 3 倍的内存带宽可带来更快的数据库处理。加入 Dell AI Data Platform 的全新数据引擎"Starburst",据称在 Vera CPU 上可将大规模 SQL 分析的查询吞吐量提升至 3 倍[1]

在本地安全守护的前沿模型与 AI 代理

戴尔在主题演讲上引用的自家调查显示,目前 67% 的 AI 工作负载运行在云之外(本地、设备端、边缘或托管机房),并且 88% 的受访者至少有一个 AI 工作负载运行在本地[1]

被定位为满足这一需求关键的,是在保护敏感数据与模型的同时进行处理的"NVIDIA Confidential Computing"。它与 Fortanix、谷歌、红帽等伙伴合作,旨在不暴露模型知识产权或数据的前提下,让企业在自有边界内安全运行前沿模型[1]

具体而言,集成 Gemini 3.0 的 Google Distributed Cloud 将在搭载英伟达 Blackwell 的"PowerEdge XE9780"上以预览形式提供;英伟达 Nemotron 等开放模型则在 Dell AI Factory 上运行。在代理方面,OpenAI 的编程助手"Codex"将与 Dell AI Data Platform 对接,并计划将其与内部代码库和业务系统相连[1]

在贴近个人工作环境的领域,采用英伟达 Grace Blackwell 架构的"Dell Pro Max with GB10/GB300"上,可运行使用英伟达 Nemotron 开放模型的桌边代理式 AI。支撑这些的,是用于构建代理的英伟达 Nemotron、代理编排,以及负责安全的开源运行时,它们在整个 Dell AI Factory 中提供[1]

总结

本次发布表明,企业 AI 应用正从概念验证迈向生产部署,进入可在本地安全且大规模运行自主代理式 AI 的阶段。Vera Rubin 服务器带来的单位 token 成本压缩、Vera CPU 与数据平台的更新,以及守护敏感数据的机制被作为一个整体方案呈现。Dell Technologies World 第二天及之后安排了更深入的讲解,相关话题也将延续至 6 月 1 日至 4 日举行的 GTC Taipei at COMPUTEX。

出典:https://blogs.nvidia.com/blog/dell-technologies-agent-enterprise-ai