Gemma-4-31B-it-assistant 和 Gemma-4-31B-IT-NVFP4 模型现已在 Amazon SageMaker JumpStart 上提供。
Google DeepMind 的 Gemma-4-31B-it-assistant 和 NVIDIA 的 Gemma-4-31B-IT-NVFP4 模型现已通过 Amazon SageMaker JumpStart 提供。这些模型为企业用例提供了强大的 Gemma 4 31B 稠密架构。经过助手微调的 Gemma-4-31B-it-assistant 在多模态推理、代码生成和代理工作流方面表现卓越。它支持文本和图像输入,具备庞大的上下文窗口,并支持超过 140 种语言。该变体在开源模型排行榜上名列前茅,性能超越更大规模的模型。它采用混合注意力机制和原生函数调用,以支持自主代理。NVIDIA 的 Gemma-4-31B-IT-NVFP4 提供相同的功能,但内存占用显著降低。该模型使用 NVIDIA ModelOpt 量化为 4 位 FP4 精度,所需内存更少,推理速度更快。此优化版本在保持高质量的同时,适用于具有成本效益的生产部署。SageMaker JumpStart 允许用户通过最少点击即可轻松部署这些模型。客户可通过 SageMaker 控制台或 SageMaker Python SDK 访问这些模型。