Qwen3.6-35B-A3B-NVFP4 和 Wan2.1... 笔记

Qwen3.6-35B-A3B-NVFP4 和 Wan2.1-T2V-1.3B-Diffusers 模型现已在 Amazon SageMaker JumpStart 上提供。

Amazon SageMaker JumpStart 现已推出两款新基础模型,进一步扩展了 AWS 客户的 AI 能力。NVIDIA 的 Qwen3.6-35B-A3B-NVFP4 针对代理式编程和长上下文推理进行了优化。该模型是阿里巴巴 Qwen3.6-35B-A3B 的量化变体,采用混合专家架构,总参数量为 350 亿,每个 token 仅激活 30 亿参数,支持高达 26.2 万 token 的上下文窗口。通过量化为 NVFP4,该模型显著降低了内存占用,同时保持了性能表现。该模型在跨对话轮次保持上下文以及多步骤代理任务方面表现卓越。阿里巴巴的 Wan2.1-T2V-1.3B-Diffusers 模型专注于文本生成视频。该模型基于扩散 Transformer 和视频变分自编码器构建,能够从文本提示生成高质量视频片段。这款 13 亿参数的模型仅需少量显存,使其适用于消费级硬件。在 RTX 4090 上,该模型可在约四分钟内生成一段 5 秒、480p 分辨率的视频。两款模型均可通过 SageMaker JumpStart 轻松部署,仅需几次点击操作。客户可在 SageMaker 控制台查找这些模型,或使用 SageMaker Python SDK 进行部署。