動察 Beating のモニタリングによると、NVIDIAは6月4日、5500億パラメータ、550億活性化のフラッグシップ大規模言語モデル「Nemotron 3 Ultra」を正式にオープンソース化しました。このモデルは、複雑な計画、推論、ツール呼び出しなどの長距離エージェントタスク向けに最適化されています。
サードパーティのベンチマークプラットフォーム「Artificial Analysis」のインテリジェンス指数において、Nemotron 3 Ultraは47.7点を獲得し、現在米国国内で最も性能の高いオープンソースウェイトモデルとなっています。しかし、グローバルなオープンソースモデルの中では、Kimi K2.6(53.9点)、MiMo-V2.5-Pro(53.8点)、DeepSeek V4 Pro(51.5点)などの複数の中国製オープンソースモデルに依然として劣っています。
技術アーキテクチャにおいて、本モデルはMamba-Transformerハイブリッド専門家混合アーキテクチャMoEを採用し、Mamba-2状態空間モデル層とTransformer自己注意層を交互に使用することで、超長コンテキスト下でのKVキャッシュの二次関数的なメモリボトルネックを回避し、極めて低いメモリオーバーヘッドで100万トークンのコンテキストウィンドウをサポートします。このハイブリッドアーキテクチャにより、エージェントタスクにおいて最大5倍のスループット向上と30%の推論コスト削減を実現しています。
エコシステムの面では、NVIDIAはNemoClawオーケストレーションブループリントとOpenShellランタイムを含むエージェントツールキット「Agent Toolkit」を同時にリリースしました。オープンソースの内容には、モデルウェイト、データセット、トレーニングレシピが直接含まれています。本モデルはHugging Face、NVIDIA NIM、OpenRouterで公開されており、エンタープライズ向けAI検索サービスプロバイダーであるGleanなどが既に導入を発表し、商用クローズドソース大規模モデルの代替として利用されています。