NVIDIAは、AIの計算需要に応えるクラウド基盤「NVIDIA AIクラウド」の世界展開を加速していると発表しました。アフリカのCassavaと南米のClaroが加わり、対応地域は6大陸に広がりました。CoreWeaveやNebiusなど多くのパートナーがAIファクトリー(AI向けの大規模な計算基盤)を増強し、エージェント型AIの拡大を支えます。
6大陸に届く「NVIDIA AIクラウド」
NVIDIA AIクラウドは、今日の主要なAIアプリを支える急増したトークン(AIが処理を行う際の生産単位)需要に応える、用途特化型クラウドの集まりです[1]。NVIDIAのフルスタックなAI基盤と一体で設計され、企業・スタートアップ・各国政府などの需要に対応します[1]。アクセラレーテッドコンピューティング、ネットワーク、AIソフトウェアを組み合わせ、学習・ファインチューニング・推論・エージェント型AI・フィジカルAI・主権AI(各国が自国で管理するAI基盤)まで幅広い用途を支えるとしています[1]。
今回、アフリカのCassavaと南米のClaroが加わったことで、NVIDIA AIクラウドの対応地域は6大陸に達しました[1]。東南アジア、オーストラリア、南北アメリカで地域展開が加速しているとしています[1]。
NVIDIA創業者兼最高経営責任者のJensen Huang氏は「あらゆる企業とあらゆる国が、データを知能へ変えるためのAIファクトリー基盤を必要としている」と述べ、モデル学習からリアルタイム推論、AIエージェントまでを地域や産業の近くで支える狙いを示しました[1]。
地域と主権AIを支える多彩なパートナー
AIクラウド事業者、通信事業者、主権AIの構築者、そして垂直統合型のインフラ事業者などが、NVIDIAと組んでAIファクトリーを建設しているとしています[1]。
CoreWeave、Firmus、IREN、Nscaleといったパートナーは、フロンティアモデル(最先端の大規模AIモデル)の開発や企業向けAI、エージェント型アプリ、大量推論に向けて基盤を拡張しています[1]。あわせてFirebird、GMI Cloud、Indosat Ooredoo Hutchison、Lambda、Naver Cloud、Sharon AI、Yotta、YTLは、新興AI企業や各国のAI施策、金融、通信、製造、教育、医療、開発者向けの基盤を支えているとしています[1]。NVIDIAは、規制産業や政府向けに、地域ごとのAIクラウドが主権的な管理や各地のコンプライアンス要件に対応できる点を強調しました[1]。
Firmus・CoreWeave・Nebiusの拡張
Firmus Technologiesは「Project Southgate」を通じ、オーストラリアのタスマニア、メルボルン、南オーストラリア、ニューサウスウェールズでAIファクトリーを展開し、再生可能エネルギーや先進的な冷却、短期間で立ち上げられるモジュール型基盤を重視しています[1]。シンガポールではST Telemedia Global Data Centresと連携して基盤を展開済みです[1]。同社の液冷システム「Firmus HyperCube」はNVIDIA DSXに沿って設計され、トークンあたりのコストを抑えながらモジュール型のAIファクトリー建設を速めることを狙うとしています[1]。
CoreWeaveは、エージェント型AIやフィジカルAI、フロンティアモデルの処理に向けて基盤を拡張しています[1]。新アーキテクチャ「NVIDIA Vera Rubin」と「NVIDIA Vera CPU」をいち早く採用し、「NVIDIA Spectrum-X Ethernet Photonics」も初期に導入することで、100万GPU規模のAIファクトリーを支えるネットワーク基盤を整えるとしています[1]。ロボティクス向けには最新の世界基盤モデル「NVIDIA Cosmos 3」を活用し、AnthropicなどのAI研究機関がCoreWeaveの基盤上で大規模なフロンティアモデルを動かしているとしています[1]。
Nebiusは、学習・推論・フィジカルAI開発に対応するフルスタックの基盤を整えています[1]。同じくVera Rubinを早期採用し、独自の「Nebius AIクラウド」や推論層「Token Factory」、新しい「Physical AI Workbench」を組み合わせます[1]。このワークベンチはCosmos 3やNVIDIA Isaac Sim、Isaac GR00Tを組み合わせ可能なワークフローとして提供し、シミュレーションや合成データから学習・評価までを速めるとしています[1]。
「Exemplar Cloud」とトークン経済性
NVIDIAが昨年導入した「Exemplar Cloud」認定では、これまでにCoreWeave、Crusoe、Lambda、Nebius、Vultr、YTLの6社が認定を取得しました[1]。本番のAI処理で一貫した性能や信頼性、効率を出せるクラウドへの需要が高まっていることを示すとしています[1]。
NVIDIAは、AIが開発段階から推論や大量の推論処理へ移るにつれ、基盤を測る指標が「発表された容量」ではなく「トークン出力の経済性」に移っていると指摘します[1]。トークンあたりのコストは、ハードウェアの性能やソフトウェアの最適化、実際の稼働率までを反映する総保有コスト(TCO)の指標であり、NVIDIAは業界で最も低いトークンあたりコストを実現していると主張しています[1]。
立ち上げを速める「NVIDIA DSX」
NVIDIA AIクラウドは、AIファクトリーの設計・構築・運用に「NVIDIA DSX」プラットフォームを採用し始めています[1]。DSXは検証済みのリファレンス設計やシミュレーション、ソフトウェアを束ね、容量の早期立ち上げと効率的な運用を支援するとしています[1]。
具体的には、配備前にAIファクトリーを検証する「DSX Sim」、電力事情に合わせて処理を動的に調整する「DSX Flex」、限られた電力の中で計算量を最大化し最大40パーセント多くのGPUを動かせる「DSX MaxLPS」、大規模な運用を自動化する「DSX OS」が挙げられています[1]。これらにより配備リスクを下げ、ワットあたりのトークン量を高め、最も低いトークンコストの実現を狙うとしています[1]。
まとめ
NVIDIAは、CassavaやClaroの追加で6大陸に広がったAIクラウドのエコシステムと、CoreWeaveやFirmus、NebiusなどパートナーによるAIファクトリーの増強を打ち出しました[1]。トークンあたりのコストを軸にした経済性と、構築を速める「NVIDIA DSX」を組み合わせ、エージェント型AIの普及に向けた地域・主権AIの基盤づくりを加速させる構えです[1]。
