阿里巴巴周一发布了 Qwen3.8-Max,称其为迄今为止最强大的模型。重量将于下周登陆 Hugging Face 和 ModelScope,这是该公司首次赠送最大比例的模型。
规格很大:总共 2.4 万亿个参数,其中 950 亿个参数随时开启。参数是模型能够处理的表盘数量。

这对于效率极其重要,因为这意味着它不需要太多资源来运行。将其视为一个巨大的图书馆,其中只有每个问题的相关书架会亮起。拥有足够好的硬件的小型企业和实验室现在能够运行最先进的模型,而无需花费与大型数据中心相同的费用。
阿里巴巴的发布帖子跳过了通常的追逐基准的叙述,而是依靠耐力。该模型花了 16 天的时间自行构建了一个编码工具——265 个提交、127 个拉取请求、151 个问题,没有人触摸键盘。它花了五天时间复制了一篇从未见过代码的研究论文,然后比论文自己的结果高出 2.7 个百分点。在一场 24 小时的机器学习竞赛中,它领先 526 支人类队伍中的 458 支队伍。
专为在竞争对手的工具内运行而设计
Qwen3.8-Max 附带 Claude Code 和 Codex 的说明,这是 Anthropic 和 OpenAI 制作的编码工具。阿里巴巴的 API 遵循两家公司的协议。它的大部分编码基准测试都是在 Claude Code 内运行的。
这些基准并没有让它变得美好。在 31 项文本测试中,Anthropic 的《神鬼寓言 5》获得了 15 个第一名,OpenAI 的 GPT-5.6 Sol 获得了 9 个第一名,Qwen 获得了 7 个第一名。在 12 项编码测试中,Qwen 只赢了一项。然而,就情报成本而言,这个模型极其廉价和高效,这意味着即使需要更多的迭代或推理,完成工作的成本也会低得多,接近《克劳德寓言5》收费的30%。
也就是说,如果转向多模式工作——文档、视频、空间推理——排名就会颠倒。 Qwen 领先该表的大部分位置。
经营策略方面也出现了逆转。今年 4 月,阿里巴巴取消了 Qwen Code 的免费服务,在领导层离职后,团队转向封闭的付费模式。我们对 Qwen 3.7 Max 的评论指出,Plus 版本将开放,而 Max 则保持锁定在 API 后面。
那扇门现在已经打开,而且时机并非偶然。中国的开放权重模型从 2024 年末占 OpenRouter 代币的不到 2% 增加到 2026 年中期的约 61%。 Qwen 超过了 Meta 的 Llama,成为世界上最自托管的模型。
与此同时,华盛顿在 6 月份对《神鬼寓言 5》和《神话 5》进行了出口管制,据报道,北京正在考虑对中国型号走向海外的限制。
因此,阿里巴巴在纸面上输了,但在分销上赢了。如果你可以免费下载一些接近的东西,那么第二名就是一个不错的地方。