开源承诺的成色

承诺了什么、兑现了多少、许可里藏着什么——Max 级第一次开放权重。这一章先记录承诺与写作时的状态,再用发布后的一手材料逐项检验。

作者 David更新于 9 篇(共 11 篇)

开源承诺的成色

本章初稿写于 2026 年 8 月 6 日,承诺到期之前;9 月 13 日按兑现情况补写了后半部分,9 月 19 日又按 Hugging Face 的提交与讨论记录订正了公开日期,补上 ModelScope、同系列的许可对比与 0902 快照。 前半部分(承诺的内容、写作时的状态、历史记录)保留原貌——先记录承诺、再对照结果,这个顺序本身就是本章的方法。

这是本专栏最需要小心措辞的一章。

承诺的内容

官方在 2026-08-03 的发布中说的是:

  • 权重将在 Hugging Face 与 ModelScope 上放出(博客);
  • 时间是“下周”,即 2026 年 8 月 10 日那一周
  • 范围包括 Qwen3.8-Max(博客)与 Qwen3.8-27B(同日的官方帖子;博客里没有提 27B)。

写作时的状态(2026 年 8 月 6 日)

项目状态
Hugging Face 上的 Qwen3.8-Max未上线
Hugging Face 上的 Qwen3.8-27B未上线
许可类型未公布
访问方式仅 API

当时承诺的时间窗还没到期,本专栏只记录状态,不做预判。

兑现情况

项目状态
Qwen3.8-Max 的开放权重已发布,名为 Qwen3.8-2.4T-A95B:8 月 8 日建仓,9 日上传权重,12 日公开(最早的社区讨论出现在当晚);另有 FP8 版
Qwen3.8-27B已发布:8 月 5 日建了空仓库,13 日上传权重,14 日公开,许可为 Apache 2.0;另有 FP8 版
许可8 月 12 日随公开补上:自订的 Qwen3.8-Max License
官方公告8 月 14 日与 27B 一起宣布,称 2.4T 的权重“也已于近日发布”
ModelScope已上线:三个模型都在 Qwen 组织下
额外发布Qwen3.8-Flash-Next(8 月 26 日,发布会上没有提到)

“8 月 10 日那周”的承诺按期兑现:Max 周三公开,27B 周五公开,而且多放了一个。

9 月 13 日那次更新把公开日期写成了 8 月 9 日,依据是 Hugging Face 的提交时间;那一天只是上传,仓库还不对外可见。提交记录记的是“什么时候传上去”,不是“什么时候放出来”——这是核对开源日期时容易踩的坑。

为什么这件事值得单独写一章

因为这是 Qwen Max 线的第一次

型号开源状态
Qwen3.6-Max-Preview闭源,仅 API
Qwen3.7-Max闭源,仅 API
Qwen3.8-Max已开放权重Qwen3.8-2.4T-A95B

Qwen 一直有两条线:Max 线走能力上限、闭源;开源线走中小尺寸(Qwen3.6-27B 这类)。3.8 这一代把 Max 开了出来,是路线上的转变,不是惯例的延续。模型卡第一段就写着:“Qwen3.8 第一次把 Max 级模型开放发布。”

这也解释了为什么 7 月预览时中文社区对“将开源”的说法普遍存疑——当时的怀疑是基于历史记录的合理推断,不是无端质疑。结果证明,这一次厂商说到做到了。

判断成色的四个维度

写作时,本章列了四件“等权重落地后要看的事”。现在逐项给出结论。

一、许可类型

写作时的分档:

档位例子
完全宽松MIT / Apache 2.0(DeepSeek V4 在这一档
有条件商用自订许可 + 营收门槛(Kimi K3 在这一档Qwen3.8-Max 也在这一档
仅研究禁止商用

结论:有条件商用。 Qwen3.8-Max License 的主体几乎就是 MIT:免费使用、复制、修改、分发、再授权、销售、部署、托管、微调、做衍生作品。附带两个条件:

  1. 大体量产品要署名。 用于月活超过 1 亿、或月营收超过 2000 万美元的商业产品或服务时,必须在界面上醒目地标出模型名。
  2. 大体量的直接竞争者要另行授权。 如果被许可方或其任一关联方在做“模型即服务”或“AI 工作助手”业务,且被许可方连同关联方在任意连续 12 个月里的合计营收超过 5000 万美元,商用前必须另外向 Qwen 申请授权。仅限内部使用、且不把软件、输出或模型能力开放给第三方的,不受此限。

第二条有两处细节值得抠。一是营收门槛算的是被许可方连同关联方的全部营收,不只是那块业务的营收——大公司只要沾了这两类业务,就会被圈进去。二是两个定义写得很具体:“模型即服务”指通过 API 或托管端点,让第三方能实质控制推理或微调的输入、参数或训练数据(单纯把请求转发给别人托管的模型不算);“AI 工作助手”指主要用于 AI 辅助编程或办公的独立产品,许可里点名的例子正是阿里自己的 Qoder 和 QwenWork,而翻译工具这类单一用途工具、淘宝购物助手这类别的领域的助手、以及作为其他产品附属功能的助手都不算。

许可里没有常见的“可接受使用政策”清单,只要求遵守法律、不侵犯第三方知识产权。

这条门槛瞄准的不是“商用”,而是“和阿里自家产品正面竞争的大厂”。 普通企业把它嵌进自己的业务、创业公司用它做产品,基本都在门槛之下;受限的是年营收 5000 万美元以上、在做模型 API 或编程/办公助手的公司——恰好是 Qwen Cloud 与 Qoder 的直接对手。

对大多数读者来说,它在实际效果上接近宽松许可;对少数大公司来说,它等于没开源。

同一代的三份开放权重,许可并不一样:

模型许可对“模型即服务 / AI 工作助手”业务
Qwen3.8-27BApache 2.0不设限
Qwen3.8-2.4T-A95BQwen3.8-Max License合计营收超过 5000 万美元才需另行授权
Qwen3.8-Flash-NextQwen Community License 1.0不论营收,只要做这两类业务,商用前都要另行授权

Flash-Next 那一行最容易被忽略:它的许可与 Max 的几乎逐字相同,只是把营收门槛整条删掉了。同系列那一章会再谈这个差别。

二、放的是哪个版本

结论:后训练之后的文本主干,不是 API 产品的全部;从 9 月起,和 API 的差距又拉开了一步。 模型卡写明,API 上的 Qwen3.8-Max 是“基于 Qwen3.8-2.4T-A95B 的官方版本”,多了视觉输入、非思考模式、默认 1M 上下文和官方内置工具。开放权重只支持文本,且必须开启思考。没有放出 base 模型。

写作时担心的“开源了一个同名但更弱的版本”,这次的处理是:名字不同,差别写明。 这是透明的做法;但也意味着模型卡里那张标着“Qwen3.8-Max”的分数表,不一定就是开放权重的分数(基准那一章专门提了这一点)。

9 月 2 日的 0902 快照让这件事更明显:API 上的 qwen3.8-max 自 9 月 5 日起已是继续后训练过的版本,Hugging Face 上的权重截至 9 月 19 日仍是 8 月 12 日那一版,官方没有说 0902 会不会开放权重。“开放了 Qwen3.8-Max 的权重”这句话,时间越往后越需要加注。

三、放的是全部还是一部分

结论:承诺的都放了,还多放了一个。 2.4T 全量权重(BF16 与 FP8 两版)、27B,另加一个发布会上没提的 Flash-Next。不是“先放小的、大的再说”。唯一没放的是后来的 0902 快照,而它本来就不在承诺之内。

四、配套材料

结论:够拆架构,不够拆训练;但外围材料比预期多。 随权重放出的有模型卡(含架构参数、分数表、调用说明)、config.json、分词器、对话模板,以及 SGLang、vLLM、TokenSpeed 的部署指引;没有 Max 本身的技术报告或论文,模型卡只引了发布博客。

发布之后,Qwen 团队又陆续公开了三样东西:oh-my-cli 演示的完整轨迹、E-Commerce Bench 的代码、数据与论文(arXiv:2608.30730),以及 Flash-Next 的技术报告。前两样让长时程那一章里的两个演示变得可以核对;第三样讲的是下一代结构,不涉及 Max 的训练。

所以“长什么样”现在能回答了(见架构拆解),“怎么练的”依然大多空白。

兑现之后意味着什么

  • 它发布时是第二大的开放权重模型:约 2.446T,仅次于 K3 的 2.8T(据 Artificial Analysis 8 月 6 日的对比;它还算过,这比阿里此前最大的开放权重模型 Qwen3.5 397B 大了约 6 倍);
  • 中国三家(Moonshot、DeepSeek、Alibaba)的旗舰全部开放了权重——这在全球范围内是独特的格局;
  • 规格总表里的空白大部分被填上了——层数、专家配置、注意力设计都从配置文件里读到了。

本专栏的更新承诺,已兑现。 权重公开后,本专栏补写了架构拆解一章,填上了规格总表的未公开清单,并更新了本章的许可评估;9 月 19 日又按一手记录订正了日期,补上了同系列的对比。

回头看“延期”与“不提了”

写作时本章说过:发布会承诺延期在这个行业是常态,真正需要警惕的不是延期,是“悄悄不提了”

这一次两者都没有发生:权重按期上线,许可随公开补齐,还多放了一个模型。只是“按期”的方式值得记一笔:先安静地公开,两天后才官宣——只盯官方公告的人,会以为它晚了两天。记录承诺、等待、再对照结果——这套做法在这里得到了一个正面的样本。

下一章看同一代的另外两份开放权重。👉 同期开放的 27B 与 Flash-Next

参考文献

本页目录