Appearance
📰 概要
2026年4月20日,阿里发布 Qwen 3.6-Max 预览版,这是 Qwen 系列新一代旗舰模型的早期版本。相比上一代 Qwen3.6-Plus,编程智能体能力跳了一截:SkillsBench 涨 9.9 分,SciCode 涨 6.3 分,NL2Repo 涨 5.0 分。
世界知识也更强了,SuperGPQA 提升 2.3 分,QwenChineseBench 提升 5.3 分。作为预览版,模型仍在迭代,但已经可以在 Qwen Studio 和阿里云百炼 API 上试用。
🔍 解读
这件事的核心意义是:国产大模型在编程智能体这个赛道,开始跟国际第一梯队贴身肉搏。SkillsBench +9.9 不是小数字,它测的是真实 GitHub issue 修复能力,这意味着 AI 写代码从"能帮点忙"往"能独立干活"又近了一步。
但有个前提:这是预览版,正式版还没来。性能数据是基于基准测试的,真实项目里表现如何,还需要你亲自试。另外,Qwen 系列的开源版本和旗舰版本有差距,开源版便宜但能力有限,旗舰版强但要付费。
💎 深挖
从版本迭代看,阿里这 18 个月走得有点快:2024 年 9 月 Qwen2.5,2025 年 4 月 Qwen3,2026 年 2 月 Qwen3.5,现在 Qwen3.6-Max 又来了。
| 版本 | 发布时间 | 核心升级 |
|---|---|---|
| Qwen2.5 | 2024.09 | 纯稠密架构,18万亿 token |
| Qwen3 | 2025.04 | 混合专家架构,多模态 |
| Qwen3.5 | 2026.02 | 推理能力强化,Thinking 系列 |
| Qwen3.6-Max | 2026.04 | 智能体编程大幅提升 |
横向对比更有意思。编程智能体这条赛道,Claude Opus 4.7 刚在 SWE-bench 破了 80%,GPT-5 和 DeepSeek V4 也在加速迭代。Qwen3.6-Max 的定位不是"最强",而是"性价比之选"——能力够用,价格比 Claude 和 GPT 低。
但对每天写代码的人来说,这可能是近期最值得关注的一个更新。你用 Qwen Studio 或者阿里云百炼,今天就能试到这个模型。
试的方式很简单:找一个真实的 GitHub issue + 报错堆栈,扔给 Qwen3.6-Max,看它能不能一次定位根因。能?可以认真考虑日常用了。
不能?至少知道它现在的边界在哪。但有个风险:编程智能体能力在涨,团队的代码审查能力可能没跟上。如果你的项目主要是 Java/Go,或者没有代码审查习惯,暂时不建议追。
