
文章摘要
Qwen3.8-Max-0902 是对总参数 2.4T(激活 95B)・100 万令牌上下文的 MoE 模型「Qwen3.8-Max」进行了针对 Coding 与 Cowork(智能体协作)的追加后训练的升级版。智能体终端编程(TerminalBench 3.0)从 11.3 提升到 29.0(约 2.6 倍),黑盒软件复现(ProgramBench)从 10.5 提升到 28.0(约 2.7 倍)。QwenCloud API 提供,输入 $2 / 输出 $6(每 100 万令牌)。
Qwen3.8-Max-0902 指南 2026:2.4T 参数 MoE 强化 Coding 与 Cowork 的升级版
2026 年 9 月 2 日,阿里 Qwen 团队(@Alibaba_Qwen)在 X 上宣布发布Qwen3.8-Max-0902——Qwen3.8-Max 的升级版。
先给结论:Qwen3.8-Max-0902 是对总参数 2.4T(激活 95B)・100 万令牌上下文的 MoE 模型「Qwen3.8-Max」进行了针对 Coding 与 Cowork(智能体协作)的追加后训练的升级版。智能体终端编程(TerminalBench 3.0)从 11.3 提升到 29.0(约 2.6 倍),黑盒软件复现(ProgramBench)从 10.5 提升到 28.0(约 2.7 倍)。QwenCloud API 提供,输入 $2 / 输出 $6(每 100 万令牌)。
「AI moving so fast that 0902 was released on 0901」——正如这条回复所说,前一天刚发布、第二天又出升级的惊人开发速度成为话题。
本文介绍 Qwen3.8-Max-0902 是什么、基准提升、价格和用法。
Qwen3.8-Max-0902 是什么
Qwen3.8-Max-0902 是阿里 Qwen 团队推出的旗舰 MoE 模型「Qwen3.8-Max」的 2026 年 9 月 2 日升级版。
| 项目 | 内容 |
|---|---|
| 提供方 | 阿里 Qwen 团队(@Alibaba_Qwen) |
| 发布日期 | 2026 年 9 月 2 日 |
| 总参数 | 2.4T(激活约 95B・MoE) |
| 上下文 | 100 万令牌 |
| 基础 | Qwen3.8-Max(追加后训练,非完全重训) |
| 强化领域 | Coding & Cowork(智能体协作) |
| 提供方式 | QwenCloud API(云端) |
| 竞品 | Claude Opus 5・Fable 5・GPT-5.6 Sol |
「0902」的含义
版本名中的「0902」表示9 月 2 日发布。Qwen3.8-Max 此前以「Qwen3.8-2.4T-A95B」名义发布;这次不是完全重训,而是聚焦 Coding 与 Cowork 的定向追加后训练。
基准:智能体编程大幅提升
Qwen3.8-Max-0902 的基准提升(对比旧版 Qwen3.8-Max):
编程
| 基准 | 旧版 | 0902 | 提升 |
|---|---|---|---|
| TerminalBench 3.0(智能体终端) | 11.3 | 29.0 | 约 2.6 倍 |
| DeepSWE 1.1(智能体编程) | 56.6 | 69.3 | +12.7 |
| NL2Repo-Bench(仓库级生成) | 55.9 | 64.9 | +9.0 |
| ProgramBench(黑盒复现) | 10.5 | 28.0 | 约 2.7 倍 |
| SWE-Marathon(超长周期 SWE) | 39.1 | 44.8 | +5.7 |
| MLS-Bench-Lite(ML 研究工程) | 41.0 | 50.1 | +9.1 |
| SWE-Atlas QnA(仓库级理解) | 60.3 | 66.3 | +6.0 |
| QwenSWE-Bench V2(真实 SWE) | 55.1 | 70.0 | +14.9 |
智能体・长周期工作
| 基准 | 旧版 | 0902 | 提升 |
|---|---|---|---|
| CoWorkBench(长周期办公) | 74.8 | 76.1 | +1.3 |
| JobBench(专业工作任务) | 53.4 | 64.0 | +10.6 |
| ToolBench Verified(真实工具使用) | 72.5 | 73.3 | +0.8 |
| WorkArena Elo(众包专家评估) | 1348 | 1468 | +120 |
多模态智能
| 基准 | 旧版 | 0902 |
|---|---|---|
| MMMU-Pro(STEM 视觉推理) | 82.3 | 82.7 |
| ERQA(具身智能) | 77.8 | 78.3 |
| ClawEval-MM(多模态工具使用) | 77.2 | 80.2 |
| BabyVision + CI(通用视觉推理) | 91.3 | 93.8 |
关键点:智能体编程与真实 SWE 的提升尤为显著,在多个类别上与 Claude Opus 5・Fable 5・GPT-5.6 Sol 竞争或接近。
价格:QwenCloud API
Qwen3.8-Max-0902 已在 QwenCloud API 上线(每 100 万令牌):
| 项目 | 价格 |
|---|---|
| 输入 | $2 |
| 输出 | $6 |
| 显式缓存命中 | $0.17 |
| 隐式缓存命中 | $0.25 |
- 显式缓存命中低至 $0.17
- 隐式缓存命中 $0.25
- 要发挥 100 万令牌上下文的性价比,为缓存命中而设计是关键
总结
Qwen3.8-Max-0902 是通过聚焦「Coding & Cowork」的追加后训练,大幅强化智能体开发的升级版。
- ✅ 总参数 2.4T(A95B 激活)MoE・100 万令牌上下文
- ✅ TerminalBench 3.0 约 2.6 倍(11.3→29.0)・ProgramBench 约 2.7 倍(10.5→28.0)
- ✅ 智能体编程・长周期 SWE・专业工作任务大幅提升
- ✅ 多模态智能全面进步
- ✅ 与 Opus 5・Fable 5・GPT-5.6 Sol 竞争的实力
- ✅ QwenCloud API 即刻可用($2/$6・缓存命中 $0.17 起)
通过 API 运行智能体编程或长周期工作流的开发者,Qwen3.8-Max-0902 是 2026 年 9 月时点最具性价比的选择之一。发布次日再出升级的速度,本身就是 Qwen 团队研发实力的证明。
链接
- X(发布帖):https://x.com/Alibaba_Qwen/status/2094968708288680276
- QwenCloud:https://qwen.cloud/
- Qwen 官网:https://qwenlm.github.io/
- 相关文章(Qwen3.8-Flash-Next GGUF):https://cldnavi.com/blog/qwen38-flash-next-gguf-guide-2026/
- 相关文章(QwenWork):https://cldnavi.com/blog/qwenwork-guide-2026/
相关文章
相关文章

2026年7月19日
【2026】Agents-A1(35B MoE)是什么?小参数却能做这些 —— 惊艳的智能体专用模型深度分析

2026年9月5日
2026 年 Ling-3.0-flash 详解:蚂蚁集团新一代混合 MoE(附医疗版 Sante 注意事项)

2026年7月28日
Kimi K3 完全指南:2.8T 全球最大开源模型,与 0.18B 超小型版(普通电脑也能跑)的全貌【2026年版】

2026年8月14日
【2026】dots3-note Preview 完全解析!RedNote 的 280B MoE 模型为何能与 DeepSeek V4 Flash 正面交锋

2026年9月1日
【2026】Qwen3.8-Flash-Next GGUF 本地运行指南:unsloth 量化、内存需求与 PC 配置

2026年7月18日
【2026】KTransformers 完全指南:24GB VRAM 就能跑 DeepSeek-R1 的 CPU-GPU 协作框架,面向初学者