宣布在 SageMaker AI 推理服务中扩展 G7e 实... 笔记

宣布在 SageMaker AI 推理服务中扩展 G7e 实例的区域支持

Amazon SageMaker 现已在首尔、伦敦和东京推出 Amazon EC2 G7e 实例,用于 AI 推理。这些实例最多配备八张 NVIDIA RTX PRO 6000 Blackwell Server Edition GPU,每张 GPU 拥有 96 GB 内存。此外,它们还搭载第五代 Intel Xeon 处理器和高带宽网络。G7e 实例的推理性能较上一代 G6e 提升高达 2.3 倍。此次扩展使用户能够在亚洲和欧洲更靠近用户的位置部署推理端点,从而降低生成式 AI 的延迟。凭借高达 768 GB 的总 GPU 内存,G7e 实例可在无需多节点配置的情况下,使用 FP8 精度运行参数量高达 700 亿的 LLM。这些实例非常适合 LLM 推理、图像和视频生成、空间计算以及科学计算。新区域已加入此前支持 G7e 实例的 SageMaker 所在地。定价详情请参阅 Amazon SageMaker 定价页面。