NVIDIA「Nemotron 3.5 Lightning」公開——Ollamaなどで手元実行
NVIDIAの30B・MoE型オープンモデルをOllamaやLM Studioなどでローカル実行できるようにした。
Ollama利用者は、高速な30B級エージェントモデルをローカル処理の新しい候補として比較できます。
ニュースをやさしく解説
結論から言うと、NVIDIAは2026年8月11日、長く動き続けるAIエージェント向けのオープンモデル「Nemotron 3.5 Lightning」を公開し、Ollama、LM Studio、llama.cpp、vLLMと連携して手元で動かせるようにした。
モデルは全体300億パラメータのMixture-of-Experts方式で、常時すべてを使うのではなく必要な専門部分を選ぶ。NVIDIAの社内比較では、同じ規模のモデルに対して出力が最大4倍速く、エージェントが課題を終える時間は30%短かったという。コードレビュー、道具の操作、セキュリティ警告の監視、請求に関する質問など、大量に繰り返す専門作業を想定する。
組織のデータや手順で追加学習でき、RTX搭載PC、DGX Spark、DGX Station、Jetson、社内サーバー、クラウドへ展開できる。モデルはHugging Face、ModelScope、OpenRouter、NVIDIA NIMなどでも提供され、学習用データセットの一部も公開された。
OllamaやLM Studioを使う人には、機密文書を外へ出さずにローカル作業を試す新しい候補になる。ただし300億規模のため、量子化しても必要なメモリや速度はPC構成で大きく変わる。最大4倍・30%短縮はNVIDIAの比較条件で、すべての課題を保証しない。モデルのライセンス、配布形式、対応タグ、GPU要件を公式ページで確認してから導入したい。
AIをもっと深く学べる本
ニュースに出てきたAIやカテゴリに近い教材を優先しています。
- Amazon機器評価順で探す ↗Amazon|ローカルLLM用ミニPC・メモリ・SSDを評価順で探すOllamaやLM Studioを自分のPCで快適に動かしたい人向けミニPC、メモリ、SSDなどをレビュー評価順で確認できます。対応メモリ規格と必要性能は公式要件と照らしてください。
- Amazon評価順で探す ↗Amazon|Python×AIプログラミング入門書を評価順で探すAIを使ったコード生成・自動化・ローカルLLM活用へ進みたい人向けPython、AI開発、Copilot/Cursor活用の周辺教材をレビュー評価順で確認できます。環境構築の難易度も見て選べます。
- ローカルLLM楽天で見る ↗ローカルLLM実践入門手元のPCでLLMを動かす考え方を知りたい人向けローカルLLMの環境構築と活用を、Python未経験者にも配慮して学べる実践入門。
広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。