NVIDIA、エッジAIモデル「Cosmos 3 Edge」を日本で発表し、フィジカルAI戦略を加速
NVIDIAは、日本におけるフィジカルAI推進の重要な一歩として、エッジデバイス向けに最適化された世界モデル「Cosmos 3 Edge」を発表しました。この動きは、日本のロボティクスおよび製造業基盤にNVIDIAの物理AIプラットフォームを深く浸透させるための広範なパートナーシップと連携しています。NVIDIAのCosmosプラットフォームは、製造、物流、ヘルスケアといった分野でのロボットの自律動作ソリューション開発において、日本の主要企業との協業の核となります。日本政府は2040年までに1,000万台のAI搭載ロボットを導入する目標を掲げ、80兆円(約4,924億ドル)の投資計画でこれを支援しており、NVIDIAの戦略はこの国の成長戦略と直接的に合致しています。
Cosmos 3 Edge:エッジデバイス向けオムニモーダル世界モデルの技術詳細
NVIDIAが新たに発表した「Cosmos 3 Edge」は、同社のCosmos 3シリーズを拡張する、40億パラメータを持つコンパクトな世界モデルです。これは、ロボットのオンデバイスでの認識とアクション生成を直接実行するために設計されており、NVIDIAのNemotronアーキテクチャを基盤としています。
Cosmos 3 Edgeの特長は、エッジAI処理に特化している点です。RTX GPU、DGXシステム、そして新発表のJetson T2000およびT3000モジュールを含むJetsonエッジコンピューティングモジュール上で動作するように最適化されています。このモデルは、Cosmos 3シリーズの「オムニモーダル(omnimodal)」な特性を受け継ぎ、世界生成、物理的推論、およびアクション生成を統合した単一の基盤モデルとして機能します。具体的には、テキスト、画像、ビデオ、環境音、およびアクション軌跡を単一の統一されたモデル内で処理および生成することができます。
アーキテクチャ的には、Cosmos 3は2つのタワーを持つMixture-of-Transformers(MoT)構造を採用しています。マルチモーダルな観測を解釈する「Reasoner Tower」と、関節角度、グリッパー位置、軌道点といったロボット制御出力を生成する「Generator Tower」で構成されます。Cosmos 3 Edgeは、既存のCosmos 3 SuperやNanoモデルとは異なり、Qwen3-VLの事前学習済み重みで初期化されるのではなく、ゼロから学習されています。開発者はオープンなCosmosフレームワークを利用することで、特定のロボット、車両、センサー、および動作環境に対して、約1日でこのベースモデルを適応させることが可能です。NVIDIAはCosmos 3モデル、学習スクリプト、デプロイメントツール、およびデータセットをオープンソース化しており、物理AI開発の透明性と再現性を高めています。
日本におけるフィジカルAIエコシステムの構築とNVIDIAの役割
NVIDIAは、日本をフィジカルAIの次の産業革命の中心地と位置づけ、大規模なインフラ投資と広範なパートナーシップを通じてその推進を図っています。その中核となるのが、日本政府、産業界、およびNVIDIAが共同で立ち上げた国家規模のAIインフラストラクチャです。
具体的には、NVIDIAは日本のAIコンソーシアムであるNoetra社(ソフトバンクグループ、ソニーグループなどが参画)と提携し、NVIDIA Vera Rubin AIファクトリーを建設します。このAIファクトリーは、日本の経済産業省(METI)が推進する「FRONTiaプロジェクト」の一部であり、フィジカルAI向けのマルチモーダル基盤モデル開発のための計算基盤を提供します。この施設には、13,750基のVera CPUと27,500基のRubin GPUが搭載され、140メガワットのデータセンター容量を提供します。建設は2027年4月に開始され、2028年6月には稼働を開始する予定です。Noetraは、2028会計年度までにテキスト、画像、ビデオ、オーディオをシームレスに処理できる国産のマルチモーダル基盤モデルを開発することを目指しています。日本は汎用AI分野で米国や中国に追いつくことの困難さを認識し、製造データと現場での産業経験を活用したフィジカルAIに焦点を当てる戦略を選択しています。
この取り組みには、ファナック、安川電機、富士通、川崎重工業、日立、NEC、ホンダR&D、Preferred Networks、クボタ、三井物産、三菱商事、Mujin、Telexistence、TIER IV、TRON K.K.、Turing、AIRoA、classmethod、Enactic、GROOVE Xなど、20社以上の日本の主要企業がNVIDIA Cosmos連合に参加する意向を示しています。これらのパートナーシップは、物理AIのオープンな基盤モデルの開発と導入を加速させ、産業用ロボット、自動運転、スマートシティ、ヘルスケアなど多岐にわたる分野でのAI活用を推進することを目的としています。
NVIDIAはまた、Cosmosベースのビデオインテリジェンスシステムを最大6倍高速に構築・運用できる新しいMetropolisライブラリも展開しており、コーディングエージェントを活用した学習とデプロイメントを可能にしています。これらの技術的進歩と戦略的提携により、NVIDIAは日本の産業界が直面する労働力不足への対応と、グローバルなAIロボティクス市場での競争力強化に貢献すると期待されています.
開発者・エンジニア視点での考察
-
エッジAIと分散型推論の可能性拡大: Cosmos 3 Edgeは40億パラメータという比較的コンパクトなサイズでありながら、オンデバイスでのリアルタイムな推論とアクション生成を可能にします。これは、クラウド依存を減らし、低遅延で高信頼性が要求される産業用ロボットや自律システムにおいて、エッジコンピューティングの導入を加速させるでしょう。JetsonプラットフォームやRTX GPU上で動作可能であることから、開発者は多様なハードウェアでフィジカルAIアプリケーションをプロトタイプから実運用へとスムーズに移行させることが期待されます。
-
オムニモーダル基盤モデルの汎用性と適応性: Cosmos 3は、テキスト、画像、ビデオ、音声、アクションといった多様なモダリティを統合的に処理するオムニモーダルな特性を持ちます。これにより、単一のモデルで物理世界の複雑な状況をより包括的に理解し、推論し、行動を生成できるため、ロボットのタスク理解と実行能力が飛躍的に向上します。開発者は、この汎用性の高い基盤モデルを、特定のロボットや環境に合わせて迅速にファインチューニングできるオープンフレームワークを活用し、カスタマイズされた物理AIソリューションを効率的に開発できるようになります。
-
国家規模のAIインフラとデータ駆動型開発: Noetra社によるNVIDIA Vera Rubin AIファクトリーの建設は、日本国内で兆パラメータ規模のAIモデル学習を可能にする強力な計算基盤を提供します。これにより、国内のAI開発者は最先端のAI環境にアクセスし、高品質な合成データ生成(SDG)やリアルワールドデータの活用を通じて、フィジカルAIモデルのトレーニングと検証を大規模に実施できるようになります。特に、日本が強みとする製造業のデータと現場経験を組み合わせることで、独自の競争力を持つ物理AIの進化が加速されるでしょう。
Source / 元記事
この記事について
この記事は、公開されているニュース、論文、公式発表、RSSフィードなどをもとに、AIが要約・補足調査・考察を行って作成しています。
元記事の完全な翻訳・逐語的な要約ではなく、AIによる背景説明や開発者向けの考察を含みます。
重要な技術仕様・価格・提供状況などは、必ず元記事または公式情報をご確認ください。


