SageMaker AI推論におけるG7eインスタンスのリージョン拡張を発表
Amazon EC2 G7e インスタンスが、ソウル、ロンドン、東京でAI推論のために Amazon SageMaker で利用可能になりました。これらのインスタンスは、最大 8 基の NVIDIA RTX PRO 6000 Blackwell Server Edition GPU を搭載し、それぞれ 96 GB のメモリを備えています。また、第 5 世代 Intel Xeon プロセッサーと高いネットワーク帯域幅も特徴です。G7e インスタンスは、前世代の G6e インスタンスと比較して、最大 2.3 倍の推論パフォーマンスを提供します。この拡張により、アジアとヨーロッパのユーザーに近い場所で推論エンドポイントをデプロイでき、生成 AI のレイテンシを削減できます。最大 768 GB の合計 GPU メモリを備えた G7e インスタンスは、マルチノード設定なしで FP8 精度を使用して最大 700 億パラメータの LLM を処理できます。これらのインスタンスは、LLM 推論、画像およびビデオ生成、空間コンピューティング、科学技術計算に最適です。新しいリージョンは、SageMaker 上の G7e インスタンスで以前からサポートされていたロケーションに加わります。価格の詳細については、Amazon SageMaker の価格ページをご覧ください。