SageMaker AI推論におけるG6インスタンスのリージョン拡張を発表
Amazon EC2 G6 インスタンスが、Amazon SageMaker AI 推論向けに AWS GovCloud (US-East) リージョンで利用可能になりました。これらのインスタンスは、NVIDIA L4 Tensor Core GPU を活用しており、それぞれ 24 GB のメモリと AMD EPYC プロセッサを搭載しています。G6 インスタンスは、G4dn インスタンスの最大 2 倍のディープラーニング推論パフォーマンスを提供します。この拡張により、GovCloud 内の政府機関は、生成 AI の推論エンドポイントをデプロイできるようになります。このようなワークロードには、言語モデル、画像生成、コンピュータービジョンタスクが含まれます。これらのデプロイは、厳格なコンプライアンスおよびデータレジデンシー規制に準拠します。G6 インスタンスは、24 GB の GPU メモリ内で、本番推論ニーズに対して優れた価格パフォーマンスを提供します。これらは現在、他のリージョンに加えて AWS GovCloud (US-East) でも利用可能です。関心のあるユーザーは、AWS の料金ページで詳細な料金情報を確認できます。この利用可能性は、政府機関の AI 機能を強化します。