Amazon SageMaker AI が NVIDIA Nemotron 3.5 Lightning モデル向けのサーバーレスモデルカスタマイズをサポート
Amazon SageMaker AI は NVIDIA Nemotron 3.5 Lightning モデル向けに、サーバーレスモデルカスタマイズを導入した。これにより、ユーザーは独自データでモデルを調整し、コストとレイテンシーを削減できる。
Amazon SageMaker AI は、NVIDIA Nemotron 3.5 Lightning モデル向けに、サーバーレスモデルカスタマイズをサポートする。このモデルは、NVIDIA の最新のオープンウェイトモデルの一つで、3B のアクティブパラメータと総計 30B パラメータを備えたハイブリッド Mixture-of-Experts アーキテクチャを採用している。SageMaker AI 上でこのモデルをデプロイするだけでなく、特定のドメインやワークフローに合わせてカスタマイズできる。モデルカスタマイズにより、独自データでファウンデーション モデルを調整し、小規模で適切なモデルで最先端モデルの品質を維持し、コストとレイテンシーを削減できる。SFT を使用してラベル付きデータでドメイン固有のタスクの精度を向上させ、DPO で組織のトーンにアウトプットを整合させる、RFT で新しいタスクのパフォーマンスを向上させることもできる。サーバーレスカスタマイズでは、SageMaker AI がインフラのプロビジョニングとトレーニングのオーケストレーションをすべて処理するため、クラスター管理ではなくデータと評価に集中できる。また、使用した分のみの料金で済む。サーバーレスモデルカスタマイズは、US East (N. Virginia)、US West (Oregon)、Asia Pacific (Tokyo)、Europe (Ireland) で利用可能。始めるには、Amazon SageMaker Studio のモデルページからカスタマイズジョブを開始するか、SageMaker Python SDK を使用してプログラムでアクセスする。詳細については、Amazon SageMaker AI モデルカスタマイズドキュメントを参照してください。
この更新の位置づけ
Amazon SageMaker AI は、AI モデルのトレーニングとデプロイを簡略化するプラットフォームであり、このアップデートにより、ユーザーはより効率的にモデルをカスタマイズできる。