AI Artificial Intelligence

ニュースリリースを伝えるニュースサイト

AWS SageMakerでNVIDIA Nemotron 3.5 Lightningをワンクリック展開

NVIDIA Nemotron 3.5 Lightningのリリースに関する公式の引用画像。

https://d2908q01vomqb2.cloudfront.net/f1f836cb4ea6efb2a0b1b99f41ad8b103eff4b59/2026/08/14/ML-21710-featured-image.png

AWSは2026年8月17日、Amazon SageMaker JumpStartにてNVIDIAの軽量モデル「Nemotron 3.5 Lightning」の利用を開始した。同モデルはエージェントワークロード向けに最適化され、単一GPUでの実行と高スループットを実現する。

AWSは2026年8月17日、Amazon SageMaker JumpStartにてNVIDIAの「Nemotron 3.5 Lightning」の利用を開始した。同モデルはエージェントワークロード向けに最適化され、単一GPUでの実行と高スループットを実現する。

このモデルは、NVIDIA Nemotron 3 Ultraを蒸留して開発されたオープンな基盤モデルである。ハイブリッドMixture-of-Experts(MoE)アーキテクチャを採用し、総パラメータ数は30Bだが、推論時にアクティブになるのは3Bのみである。これにより、単一の対応GPUで動作可能となり、最先端レベルのインフラを必要とせずとも、反復的で専門的なエージェントワークフローを実行できる。

パフォーマンス面では、NVIDIAによると高負荷のエージェントワークロードにおいて最大4倍のスループット向上と、タスク完了が最大30%高速化されるという。また、DFlashという推測デコーディング技術によりトークンあたりのレイテンシを低減し、1Mトークンのコンテキスト長を持つため、長時間にわたるセッションでも状態の維持が可能である。

SageMaker JumpStartからの展開では、推論インフラを手動で構成する手間が省ける。NVFP4およびBF16の2つのバリアントから選択でき、SageMaker StudioやHugging Faceのモデルページ、Python SDKを通じてデプロイできる。ユーザーは独自のドメインデータで後期訓練を行い、結果となる重みを引き続き所有・管理できる柔軟性も備えている。

発表元: https://aws.amazon.com/blogs/machine-learning/nvidia-nemotron-3-5-lightning-now-available-in-amazon-sagemaker-jumpstart/