AIニュース

NVIDIA、常時稼働AIエージェント向け軽量オープンモデル「Nemotron 3.5 Lightning」を公開

公開日: ・出典: NVIDIA Technical Blog

NVIDIAは2026年8月11日、常時稼働するAIエージェント向けに設計した軽量オープンモデル「Nemotron 3.5 Lightning」を公開しました。総パラメータ数300億・アクティブパラメータ数30億のMoE(専門家混合)構成で、Mamba-2とMoE、Attentionを組み合わせたハイブリッドアーキテクチャを採用し、100万トークンのコンテキストウィンドウに対応します。20兆トークン超のデータでNVFP4レシピを用いて事前学習されており、重みは許諾範囲の広いOpenMDW-1.1ライセンスで公開されました。

同モデルは、大規模な推論モデルが計画・オーケストレーションを担う一方で、ツール呼び出しやリトリーバル、検証、フォーマット整形、分類、要約といったエージェントシステムの「実行層」を高速・低コストで担わせることを目的に設計されています。より大規模な「Nemotron 3 Ultra」から蒸留する形で構築されました。ベンチマーク「PinchBench」では86%の精度を達成しつつ、同程度の精度のQwen3.6 35Bに対して処理速度が30%速く、同規模のオープンモデルと比べ最大4倍のスループット・出力速度を実現するとしています。

NVIDIAは同時に、複数モデルを使い分けるルーター「NeMo Switchyard」も発表しました。Nemotron 3.5 Lightningは、OpenClawやHermes Agentなどのエージェントハーネスに対応し、常時稼働型AIエージェントの運用・管理を担うオープンソースのセキュリティスタック「NemoClaw」とあわせて利用できます。オープンウェイトモデルがエージェント運用のコスト・レイテンシ面で商用APIに対抗する動きの一環と位置付けられます。

出典: NVIDIA Technical Blog

Xでシェア