Qwen3.8-Max 正式发布:开发者指南——解读阿里巴巴... 笔记

Qwen3.8-Max 正式发布:开发者指南——解读阿里巴巴 2.4T 参数模型”

阿里巴巴发布了 Qwen3.8-Max,这是一款强大的 2.4 万亿参数混合专家模型。该模型具备 100 万 token 的上下文窗口,支持文本、图像和视频输入。其 API 兼容 OpenAI 和 Anthropic 协议,便于开发者集成。定价为每百万输入 token 2 美元,每百万输出 token 6 美元。一个显著的成本节约因素是缓存输入 token 的价格降低,突显了提示词中稳定前缀的重要性。该模型的命名规范区分了迭代版本与点发布版本,其中 Qwen3.8-Max 为最新旗舰版本。尽管其总参数量为 2.4 万亿,但每个 token 仅激活约 950 亿个参数,从而提升了推理效率。有效上下文窗口约为 99.1K token,最大输出 token 限制为 13.1K。开发者可通过更新基础 URL 和模型名称来使用其兼容 OpenAI 的 API。阿里巴巴的 DashScope SDK 提供了一个代码示例,展示了其多模态能力。该模型支持多种功能,包括函数调用和结构化输出,并内置五种工具。基准测试显示,其在多模态和代理任务方面表现强劲,但在某些方面仍落后于 Claude 3.5 等竞争对手。预计不久将发布开放权重版本,同时还将推出一个 270 亿参数的小型版本。目前,缺少包含详细训练数据和安全评估的正式模型卡片。商业使用的许可条款将在开放权重发布后明确。活跃参数数量已公布,但尚未得到阿里巴巴的官方确认。尽管存在上述缺失,Qwen3.8-Max 仍被推荐用于多模态应用、长上下文任务以及现有 OpenAI/Anthropic 协议用户。