新機能

Amazon SageMaker JumpStart で Gemma-4-31B-it-assistant および Gemma-4-31B-IT-NVFP4 モデルが利用可能に

Amazon SageMaker JumpStart に Google DeepMind の Gemma-4-31B-it-assistant および NVIDIA の Gemma-4-31B-IT-NVFP4 モデルが追加され、エンタープライズ AI ワークロードに対応する基盤モデルポートフォリオが拡大した。

Google DeepMind の Gemma-4-31B-it-assistant および NVIDIA の Gemma-4-31B-IT-NVFP4 モデルが Amazon SageMaker JumpStart で利用可能になった。これらのモデルは、Google のフラッグシップ 31B デンスアーキテクチャをエンタープライズワークロードに適用し、完全精度のバリアントと最適化された量子化バリアントの両方を提供する。Gemma-4-31B-it-assistant は、マルチモーダル推論やコーディング、エージェントワークフローに特化し、テキストと画像 (動画はフレームシーケンスとして扱う) を入力し、テキストを出力する。256K トークンのコンテキストウィンドウと 140 以上の言語をサポートし、Arena AI テキストリーダーボードでオープンなモデルの中位 3 位を獲得した。Gemma-4-31B-IT-NVFP4 は、NVIDIA の ModelOpt フレームワークで 4 ビット FP4 精度に量子化し、メモリ使用量を約 18.5 GB (ベースモデルより 68% 小さく) に削減し、推論速度を約 2.5 倍に高速化する一方で、元のモデルの品質の 97-99% を維持する。SageMaker JumpStart では、これらのモデルを数クリックでデプロイでき、特定の AI ユースケースに対応できる。

この更新の位置づけ

Amazon SageMaker JumpStart は、AWS カスタマーが AI 基盤モデルを簡単に利用できるプラットフォームであり、これらの新しいモデルの追加により、マルチモーダル推論やエージェント開発など、さまざまな AI アプリケーションに対応できる。

AWS 公式の元記事を読む