Ollamaは2026年8月11日、NVIDIAが開発した「Nemotron 3.5 Lightning」の提供を開始したと発表しました。このモデルはローカルデバイス上での動作に最適化されており、エージェントによる継続的なタスク実行を支援します。
エージェント機能に特化したローカル動作モデル
Nemotron 3.5 Lightningは、300億パラメータ(推論時は30億パラメータを使用)を持つオープンモデルです。Mixture-of-Experts(混合専門家)アーキテクチャを採用しており、ファイルの読み取りやツールの呼び出し、失敗した処理の再試行といった、エージェントによる多段階のタスク実行に適しています。ローカル環境で動作するため、データが外部に送信されない利点があります。
高いスループットと広大なコンテキスト窓
本モデルは、マルチトークン予測(MTP)などの技術により、同規模の他のオープンモデルと比較して最大4倍の処理能力を実現しています。また、最大100万トークンのコンテキスト長を備えており、マルチターン(対話継続型)のワークフローにおける長い履歴の保持が可能です。タスク完了時間は、同規模の主要なオープンモデルより30%高速化されています。
多様な活用シーンへの対応
開発者は、メールやカレンダーを扱うパーソナルアシスタント、コードベースの検索やリファクタリングを行うコーディング用サブエージェント、セキュリティ運用におけるログ照会など、幅広い用途に活用できます。また、オープンなデータセットで学習されているため、特定のタスクに合わせて追加学習を行い、エッジからデータセンターまであらゆる環境で実行可能です。
