OllamaローカルLLM確認済み

NVIDIA「Nemotron 3.5 Lightning」公開——Ollamaなどで手元実行

NVIDIAの30B・MoE型オープンモデルをOllamaやLM Studioなどでローカル実行できるようにした。

  • 2026-08-11
  • 最終確認日 2026-08-12
自分にどう関係する?

Ollama利用者は、高速な30B級エージェントモデルをローカル処理の新しい候補として比較できます。

ニュースをやさしく解説

結論から言うと、NVIDIAは2026年8月11日、長く動き続けるAIエージェント向けのオープンモデル「Nemotron 3.5 Lightning」を公開し、Ollama、LM Studio、llama.cpp、vLLMと連携して手元で動かせるようにした。

モデルは全体300億パラメータのMixture-of-Experts方式で、常時すべてを使うのではなく必要な専門部分を選ぶ。NVIDIAの社内比較では、同じ規模のモデルに対して出力が最大4倍速く、エージェントが課題を終える時間は30%短かったという。コードレビュー、道具の操作、セキュリティ警告の監視、請求に関する質問など、大量に繰り返す専門作業を想定する。

組織のデータや手順で追加学習でき、RTX搭載PC、DGX Spark、DGX Station、Jetson、社内サーバー、クラウドへ展開できる。モデルはHugging Face、ModelScope、OpenRouter、NVIDIA NIMなどでも提供され、学習用データセットの一部も公開された。

OllamaやLM Studioを使う人には、機密文書を外へ出さずにローカル作業を試す新しい候補になる。ただし300億規模のため、量子化しても必要なメモリや速度はPC構成で大きく変わる。最大4倍・30%短縮はNVIDIAの比較条件で、すべての課題を保証しない。モデルのライセンス、配布形式、対応タグ、GPU要件を公式ページで確認してから導入したい。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

NVIDIA Blog 公式を開く