开源承诺的成色
承诺了什么、兑现了多少、许可里藏着什么——Max 级第一次开放权重。这一章先记录承诺与写作时的状态,再用发布后的一手材料逐项检验。
开源承诺的成色
本章初稿写于 2026 年 8 月 6 日,承诺到期之前;9 月 13 日按兑现情况补写了后半部分,9 月 19 日又按 Hugging Face 的提交与讨论记录订正了公开日期,补上 ModelScope、同系列的许可对比与 0902 快照。 前半部分(承诺的内容、写作时的状态、历史记录)保留原貌——先记录承诺、再对照结果,这个顺序本身就是本章的方法。
这是本专栏最需要小心措辞的一章。
承诺的内容
官方在 2026-08-03 的发布中说的是:
- 权重将在 Hugging Face 与 ModelScope 上放出(博客);
- 时间是“下周”,即 2026 年 8 月 10 日那一周;
- 范围包括 Qwen3.8-Max(博客)与 Qwen3.8-27B(同日的官方帖子;博客里没有提 27B)。
写作时的状态(2026 年 8 月 6 日)
| 项目 | 状态 |
|---|---|
| Hugging Face 上的 Qwen3.8-Max | 未上线 |
| Hugging Face 上的 Qwen3.8-27B | 未上线 |
| 许可类型 | 未公布 |
| 访问方式 | 仅 API |
当时承诺的时间窗还没到期,本专栏只记录状态,不做预判。
兑现情况
| 项目 | 状态 |
|---|---|
| Qwen3.8-Max 的开放权重 | 已发布,名为 Qwen3.8-2.4T-A95B:8 月 8 日建仓,9 日上传权重,12 日公开(最早的社区讨论出现在当晚);另有 FP8 版 |
| Qwen3.8-27B | 已发布:8 月 5 日建了空仓库,13 日上传权重,14 日公开,许可为 Apache 2.0;另有 FP8 版 |
| 许可 | 8 月 12 日随公开补上:自订的 Qwen3.8-Max License |
| 官方公告 | 8 月 14 日与 27B 一起宣布,称 2.4T 的权重“也已于近日发布” |
| ModelScope | 已上线:三个模型都在 Qwen 组织下 |
| 额外发布 | Qwen3.8-Flash-Next(8 月 26 日,发布会上没有提到) |
“8 月 10 日那周”的承诺按期兑现:Max 周三公开,27B 周五公开,而且多放了一个。
9 月 13 日那次更新把公开日期写成了 8 月 9 日,依据是 Hugging Face 的提交时间;那一天只是上传,仓库还不对外可见。提交记录记的是“什么时候传上去”,不是“什么时候放出来”——这是核对开源日期时容易踩的坑。
为什么这件事值得单独写一章
因为这是 Qwen Max 线的第一次。
| 型号 | 开源状态 |
|---|---|
| Qwen3.6-Max-Preview | 闭源,仅 API |
| Qwen3.7-Max | 闭源,仅 API |
| Qwen3.8-Max | 已开放权重(Qwen3.8-2.4T-A95B) |
Qwen 一直有两条线:Max 线走能力上限、闭源;开源线走中小尺寸(Qwen3.6-27B 这类)。3.8 这一代把 Max 开了出来,是路线上的转变,不是惯例的延续。模型卡第一段就写着:“Qwen3.8 第一次把 Max 级模型开放发布。”
这也解释了为什么 7 月预览时中文社区对“将开源”的说法普遍存疑——当时的怀疑是基于历史记录的合理推断,不是无端质疑。结果证明,这一次厂商说到做到了。
判断成色的四个维度
写作时,本章列了四件“等权重落地后要看的事”。现在逐项给出结论。
一、许可类型
写作时的分档:
| 档位 | 例子 |
|---|---|
| 完全宽松 | MIT / Apache 2.0(DeepSeek V4 在这一档) |
| 有条件商用 | 自订许可 + 营收门槛(Kimi K3 在这一档;Qwen3.8-Max 也在这一档) |
| 仅研究 | 禁止商用 |
结论:有条件商用。 Qwen3.8-Max License 的主体几乎就是 MIT:免费使用、复制、修改、分发、再授权、销售、部署、托管、微调、做衍生作品。附带两个条件:
- 大体量产品要署名。 用于月活超过 1 亿、或月营收超过 2000 万美元的商业产品或服务时,必须在界面上醒目地标出模型名。
- 大体量的直接竞争者要另行授权。 如果被许可方或其任一关联方在做“模型即服务”或“AI 工作助手”业务,且被许可方连同关联方在任意连续 12 个月里的合计营收超过 5000 万美元,商用前必须另外向 Qwen 申请授权。仅限内部使用、且不把软件、输出或模型能力开放给第三方的,不受此限。
第二条有两处细节值得抠。一是营收门槛算的是被许可方连同关联方的全部营收,不只是那块业务的营收——大公司只要沾了这两类业务,就会被圈进去。二是两个定义写得很具体:“模型即服务”指通过 API 或托管端点,让第三方能实质控制推理或微调的输入、参数或训练数据(单纯把请求转发给别人托管的模型不算);“AI 工作助手”指主要用于 AI 辅助编程或办公的独立产品,许可里点名的例子正是阿里自己的 Qoder 和 QwenWork,而翻译工具这类单一用途工具、淘宝购物助手这类别的领域的助手、以及作为其他产品附属功能的助手都不算。
许可里没有常见的“可接受使用政策”清单,只要求遵守法律、不侵犯第三方知识产权。
这条门槛瞄准的不是“商用”,而是“和阿里自家产品正面竞争的大厂”。 普通企业把它嵌进自己的业务、创业公司用它做产品,基本都在门槛之下;受限的是年营收 5000 万美元以上、在做模型 API 或编程/办公助手的公司——恰好是 Qwen Cloud 与 Qoder 的直接对手。
对大多数读者来说,它在实际效果上接近宽松许可;对少数大公司来说,它等于没开源。
同一代的三份开放权重,许可并不一样:
| 模型 | 许可 | 对“模型即服务 / AI 工作助手”业务 |
|---|---|---|
| Qwen3.8-27B | Apache 2.0 | 不设限 |
| Qwen3.8-2.4T-A95B | Qwen3.8-Max License | 合计营收超过 5000 万美元才需另行授权 |
| Qwen3.8-Flash-Next | Qwen Community License 1.0 | 不论营收,只要做这两类业务,商用前都要另行授权 |
Flash-Next 那一行最容易被忽略:它的许可与 Max 的几乎逐字相同,只是把营收门槛整条删掉了。同系列那一章会再谈这个差别。
二、放的是哪个版本
结论:后训练之后的文本主干,不是 API 产品的全部;从 9 月起,和 API 的差距又拉开了一步。 模型卡写明,API 上的 Qwen3.8-Max 是“基于 Qwen3.8-2.4T-A95B 的官方版本”,多了视觉输入、非思考模式、默认 1M 上下文和官方内置工具。开放权重只支持文本,且必须开启思考。没有放出 base 模型。
写作时担心的“开源了一个同名但更弱的版本”,这次的处理是:名字不同,差别写明。 这是透明的做法;但也意味着模型卡里那张标着“Qwen3.8-Max”的分数表,不一定就是开放权重的分数(基准那一章专门提了这一点)。
9 月 2 日的 0902 快照让这件事更明显:API 上的 qwen3.8-max 自 9 月 5 日起已是继续后训练过的版本,Hugging Face 上的权重截至 9 月 19 日仍是 8 月 12 日那一版,官方没有说 0902 会不会开放权重。“开放了 Qwen3.8-Max 的权重”这句话,时间越往后越需要加注。
三、放的是全部还是一部分
结论:承诺的都放了,还多放了一个。 2.4T 全量权重(BF16 与 FP8 两版)、27B,另加一个发布会上没提的 Flash-Next。不是“先放小的、大的再说”。唯一没放的是后来的 0902 快照,而它本来就不在承诺之内。
四、配套材料
结论:够拆架构,不够拆训练;但外围材料比预期多。 随权重放出的有模型卡(含架构参数、分数表、调用说明)、config.json、分词器、对话模板,以及 SGLang、vLLM、TokenSpeed 的部署指引;没有 Max 本身的技术报告或论文,模型卡只引了发布博客。
发布之后,Qwen 团队又陆续公开了三样东西:oh-my-cli 演示的完整轨迹、E-Commerce Bench 的代码、数据与论文(arXiv:2608.30730),以及 Flash-Next 的技术报告。前两样让长时程那一章里的两个演示变得可以核对;第三样讲的是下一代结构,不涉及 Max 的训练。
所以“长什么样”现在能回答了(见架构拆解),“怎么练的”依然大多空白。
兑现之后意味着什么
- 它发布时是第二大的开放权重模型:约 2.446T,仅次于 K3 的 2.8T(据 Artificial Analysis 8 月 6 日的对比;它还算过,这比阿里此前最大的开放权重模型 Qwen3.5 397B 大了约 6 倍);
- 中国三家(Moonshot、DeepSeek、Alibaba)的旗舰全部开放了权重——这在全球范围内是独特的格局;
- 规格总表里的空白大部分被填上了——层数、专家配置、注意力设计都从配置文件里读到了。
回头看“延期”与“不提了”
写作时本章说过:发布会承诺延期在这个行业是常态,真正需要警惕的不是延期,是“悄悄不提了”。
这一次两者都没有发生:权重按期上线,许可随公开补齐,还多放了一个模型。只是“按期”的方式值得记一笔:先安静地公开,两天后才官宣——只盯官方公告的人,会以为它晚了两天。记录承诺、等待、再对照结果——这套做法在这里得到了一个正面的样本。
下一章看同一代的另外两份开放权重。👉 同期开放的 27B 与 Flash-Next
参考文献
- [1] Qwen Team. “Qwen3.8-Max:编程与办公,全面跃升.” 2026-08-03 —— 开放平台与“下周”的承诺。
- [2] Qwen 官方 X 帖子:正式发布与 27B 的承诺(2026-08-03)、27B 与 2.4T 权重的公告(2026-08-14)。
- [3] 第三方报道(2026-08-04)—— 写作时“仍未上线 Hugging Face、许可未公布、仅 API”的确认(二手,待核)。
- [4] DataLearner 模型库 Qwen3.7-Max / Qwen3.6-Max-Preview 条目 —— 前两代的闭源记录(二手)。
- [5] Qwen Team. Qwen3.8-2.4T-A95B 模型卡 与同仓库 LICENSE(Qwen3.8-Max License),2026-08。
- [6] Hugging Face 上 Qwen 官方组织的仓库、提交记录与社区讨论(Qwen3.8-2.4T-A95B、Qwen3.8-27B、Qwen3.8-Flash-Next 及各自的 FP8 版);ModelScope 上的同名模型。
- [7] Qwen Team. Qwen3.8-27B 的 LICENSE(Apache 2.0)与 Qwen3.8-Flash-Next 的 LICENSE(Qwen Community License 1.0)。
- [8] Artificial Analysis. Qwen3.8 Max 评测帖子,2026-08-06 —— 规模对比。
- [9] 阿里云. “Model Studio Update Notice for Qwen3.8-Max Models.” —— 9 月 5 日起
qwen3.8-max指向 0902。