英伟达宣布正在加速面向 AI 算力需求的云基础设施"英伟达 AI 云"的全球部署。随着非洲的 Cassava 和南美的 Claro 加入,其覆盖范围已扩展至六大洲。CoreWeave、Nebius 等众多合作伙伴正在扩建 AI 工厂(面向 AI 的大规模算力基础设施),以支撑智能体 AI 的扩张。
覆盖六大洲的"英伟达 AI 云"
英伟达 AI 云是一组专用云的集合,用于满足当今主流 AI 应用背后激增的 token(AI 处理时的生产单位)需求[1]。它与英伟达的全栈 AI 基础设施一体化设计,可满足企业、初创公司以及各国政府等的需求[1]。通过将加速计算、网络与 AI 软件相结合,它能够支持训练、微调、推理、智能体 AI、物理 AI 以及主权 AI(各国在本国境内自主管理的 AI 基础设施)等广泛用途[1]。
此次随着非洲的 Cassava 与南美的 Claro 加入,英伟达 AI 云的覆盖范围达到了六大洲[1]。在东南亚、澳大利亚以及南北美洲,区域部署正在加速[1]。
英伟达创始人兼首席执行官黄仁勋表示:"每一家企业、每一个国家都需要 AI 工厂基础设施,以将数据转化为智能。"他由此强调了在贴近各地区与各产业之处,支撑从模型训练到实时推理乃至 AI 智能体的目标[1]。
支撑区域与主权 AI 的多元合作伙伴
AI 云服务商、电信运营商、主权 AI 建设方以及垂直整合型基础设施提供商等,正与英伟达携手建设 AI 工厂[1]。
CoreWeave、Firmus、IREN、Nscale 等合作伙伴,正面向前沿模型(最先进的大规模 AI 模型)开发、企业级 AI、智能体应用以及高并发推理扩建基础设施[1]。此外,Firebird、GMI Cloud、Indosat Ooredoo Hutchison、Lambda、Naver Cloud、Sharon AI、Yotta 与 YTL 则在支撑新兴 AI 企业、各国 AI 计划,以及金融、电信、制造、教育、医疗和开发者生态[1]。针对受监管行业与政府,英伟达强调,区域性 AI 云能够满足主权管控与当地合规要求[1]。
Firmus、CoreWeave 与 Nebius 的扩张
Firmus Technologies 通过"Project Southgate",在澳大利亚的塔斯马尼亚、墨尔本、南澳大利亚州与新南威尔士州部署 AI 工厂,并重视可再生能源、先进散热以及可快速上线的模块化基础设施[1]。在新加坡,它已与 ST Telemedia Global Data Centres 合作完成部署[1]。其液冷系统 Firmus HyperCube 依据 NVIDIA DSX 设计,旨在在压低单位 token 成本的同时,加快模块化 AI 工厂的建设[1]。
CoreWeave 正面向智能体 AI、物理 AI 与前沿模型处理扩建基础设施[1]。作为 NVIDIA Vera Rubin 架构与 NVIDIA Vera CPU 的早期采用者,它还率先部署了 NVIDIA Spectrum-X Ethernet Photonics,为百万级 GPU 规模的 AI 工厂构建网络基础[1]。在机器人领域,它采用最新的世界基础模型 NVIDIA Cosmos 3,而 Anthropic 等 AI 实验室正在 CoreWeave 的基础设施上运行大规模前沿模型[1]。
Nebius 正搭建面向训练、推理与物理 AI 开发的全栈基础设施[1]。它同样早期采用了 Vera Rubin,并将自有的 Nebius AI Cloud、推理层 Token Factory 与全新的 Physical AI Workbench 结合在一起[1]。该工作台将 Cosmos 3、NVIDIA Isaac Sim 与 Isaac GR00T 作为可组合的工作流提供,帮助团队更快地从仿真与合成数据迈向训练与评估[1]。
"Exemplar Cloud"与 token 经济性
在英伟达去年推出的"Exemplar Cloud"认证中,迄今已有 CoreWeave、Crusoe、Lambda、Nebius、Vultr 与 YTL 这 6 家获得该认证[1]。英伟达表示,这反映出市场对能够在生产环境中提供稳定性能、可靠性与高效率的云的需求正在上升[1]。
英伟达指出,随着 AI 从开发阶段转向推理与高并发推理处理,衡量基础设施的标准正从"已宣布的容量"转向"token 输出的经济性"[1]。单位 token 成本是一项涵盖硬件性能、软件优化与实际利用率的总拥有成本(TCO)指标,英伟达声称自身实现了业界最低的单位 token 成本[1]。
加快上线的 NVIDIA DSX
英伟达 AI 云开始采用 NVIDIA DSX 平台来设计、构建与运营 AI 工厂[1]。DSX 汇集经过验证的参考设计、仿真与软件,帮助更快地让产能上线并更高效地运营[1]。
具体而言,包括在部署前对 AI 工厂进行验证的 DSX Sim、根据电网状况动态调整负载的 DSX Flex、在有限电力预算内最大化算力并可多运行最多 40% GPU 的 DSX MaxLPS,以及实现大规模运营自动化的 DSX OS[1]。英伟达表示,这些组件可降低部署风险、提升每瓦 token 产出,并力求实现最低的单位 token 成本[1]。
总结
英伟达推出了随 Cassava 与 Claro 加入而扩展至六大洲的 AI 云生态,以及由 CoreWeave、Firmus、Nebius 等合作伙伴扩建的 AI 工厂[1]。通过将以单位 token 成本为核心的经济性,与加快建设的 NVIDIA DSX 相结合,该公司正着力加速面向智能体 AI 普及的区域与主权 AI 基础设施建设[1]。
