---
source_url: https://blogs.nvidia.com/blog/nemotron-lightning-switchyard-rtx-dgx/
source_title: "NVIDIA Nemotron 3.5 Lightning and NeMo Switchyard Deliver Faster, Smarter, More Efficient Agentic AI"
source_site: "NVIDIA Blog"
source_published_at: 2026-08-11T13:00:05+00:00
hero_image: https://blogs.nvidia.com/wp-content/uploads/2026/08/image1.jpeg
tags: agentic-ai,open-models,ai-routing
generated_at: 2026-08-11T20:00:42.214Z
model: claude-haiku-4-5
---
# NVIDIAがNemotron 3.5 Lightningとスマートルーティング機能を発表

TL;DRを生成中...

NVIDIA は 30 億パラメータの軽量言語モデル「Nemotron 3.5 Lightning」と、AI エージェント向けのインテリジェントなモデルルーティングライブラリ「NeMo Switchyard」を 2026 年 8 月 11 日にリリースした。同モデルはアジェント AI のタスク処理において、従来モデルより 30% 高速化を実現する。

NVIDIA が Nemotron 3 モデルファミリーを拡張し、エージェント AI ワークロード向けの高効率モデル「Nemotron 3.5 Lightning」を発表した。30 億パラメータの Mixture-of-Experts モデルとして設計された本モデルは、より大規模なマルチエージェントシステム内での特定タスク実行を目的としている。同時に NVIDIA は、人気のあるエージェントツール内でのスマートルーティングを実現するオープンソースライブラリ「NeMo Switchyard」をリリースした。

## モデルの性能と特性

Nemotron 3.5 Lightning は最大 4x の高速な出力スピードを実現し、同クラスの他のモデルと比較して、アジェント AI タスクの完了時間を 30% 削減する。このモデルは NVIDIA NeMo を使用して、組織独自のドメインデータで追加学習が可能である。

![Nemotron 3.5 Lightning のポジショニング](https://blogs.nvidia.com/wp-content/uploads/2026/08/nemotron-3-5-lightening-launch-1680x945.png)

Nemotron 3.5 Lightning は NVIDIA RTX PC、NVIDIA DGX Spark、NVIDIA DGX Station、NVIDIA Jetson 上で実行できる。NVIDIA は Nemotron-RL-Agentic-Terminal-Pivot データセットをリリースしており、同モデルは Hugging Face、ModelScope、OpenRouter、build.nvidia.com で利用可能である。

## 企業の導入実績

複数の企業がすでに Nemotron 3.5 Lightning の導入・カスタマイズを進めており、大幅な効率改善を報告している。CrowdStrike はサイバーセキュリティ向けにカスタマイズし、Harvey with Trajectory は法務サービス向け、CodeRabbit with Baseten はコードレビュー向けに調整した。Lila Sciences は物理・生命科学領域での推論能力向上に取り組み、Fastino Labs はソフトウェア開発、金融、ヘルスケア向けにモデルを最適化している。

## NeMo Switchyard の活用事例

NeMo Switchyard はフロンティアレベルの精度を維持しながら、タスク完了コストを Opus 4.8 単独使用時の約 3 分の 1 に削減する。Boomi は 100% のドメインルーティング精度を達成し、高速なファインチューンモデルへのトラフィック 59% を振り向け、後続ターンのレイテンシを 21% 削減した。Cadence は効率を 9.9% 向上させ、Classmethod はコストを 27% 削減している。

Cognition は平均コストを 28% 削減し、FrontierCode Main でフロンティアレベルの性能に近い結果を得た。LangChain は 145 件のマルチターン Deep Agents タスクで 74% のコスト削減を実現し、フロンティアモデルへのルーティングをわずか 7% に抑えながら、精度トレードオフは 6% に留めた。Ramp は Ramp SWE-Bench でコストを 58% 削減し、ランタイムを 33% 短縮した。

その他、Kong は NeMo Switchyard をネイティブに Kong AI Gateway 経由でルーティング機能を提供し、LiteLLM はプロキシレイヤーへのプラグインとして NeMo Switchyard を追加している。Nous Research は Hermes に統合し、Siemens は Fuse EDA AI Agent の効率向上のため NeMo Switchyard をベンチマーク中である。

![NeMo Switchyard のルーティング性能](https://blogs.nvidia.com/wp-content/uploads/2026/08/nemotron-3.5-lightning-positioning-chart3-1680x945.png)

NeMo Switchyard は GitHub 上で利用可能である。

*この記事は元記事の事実のみに基づいて自動生成されました。*

## 筆者の見立て

- オープンモデルは、AI がどこで実行され、どのように展開・進化するかについての完全な制御を求める市場のニーズに応えていると解釈している
- Nemotron 3.5 Lightning はより賢く、より効率的なアジェント AI アプリケーション構築を支援する可能性を示唆している
- 企業は NeMo Switchyard を活用して、自社固有のニーズに基づくルーターを構築できる可能性を示唆している

## 出典

NVIDIA Blog「NVIDIA Nemotron 3.5 Lightning and NeMo Switchyard Deliver Faster, Smarter, More Efficient Agentic AI」
https://blogs.nvidia.com/blog/nemotron-lightning-switchyard-rtx-dgx/
(PinchBench の報道による)
