开放权重许可证。
真正会挡住你上线一个开放权重模型的,几乎从来不是 copyleft——而是一条挂在你是谁、而不是挂在你造了什么上的条款,这意味着两家公司可以跑着字节完全相同的权重,而只有一家是合规的。这就是值得随身带着的那个区分:一份标准许可证(Apache 2.0、MIT)读一个文件就能一次性清干净,而一份定制的模型协议,必须对着你自己的用户数、你自己的司法辖区,以及一份挂在某个 URL 上、不做版本号变更就会改的使用政策,一次次重新清。好消息是整个行业在 2026 年一直在朝前一种迁移;坏消息是,落在后一种之下的,正是你早就部署出去的那些模型。
有三份互不相同的文件都被叫作「许可证」。
「开放权重」说的是分发这件事——你可以把参数下载下来——而关于「许可」它什么也没说。许可来自最多三份文件,由不同的人撰写,按不同的节奏变动;一个只引用其中一份的合规回答,不算回答。
- 权重许可证。管的是复制、修改、再分发和对外提供参数文件这几件事。这是人们嘴里说的那一份,也是三者中唯一通常会随发布一起做版本管理的一份。
- 可接受使用政策(AUP)。一张禁止用途清单,几乎总是以引用方式指向一个活的 URL,而不是被固定进许可证正文里。Apache 2.0 的权重照样可以附带一份——宽松许可证覆盖的是版权授予,而 AUP 是与它并行挂着的。
- 输出条款。你能不能用这个模型的输出去训练另一个模型,以及有没有人对你部署所生成的东西主张权利。「蒸馏」这个问题就住在这里,它与「你到底有没有权利把这东西跑起来」是两件事——参见蒸馏与量化与智能体输出的知识产权与版权。
会动的是中间那一份。仓库里的许可证文件有你能 diff 的提交历史;厂商 URL 上的一份政策不一定有,而你「继续跑去年那个检查点」的资格可能在你的锁文件毫无变化的情况下就变了。如果你选开放权重是有理由的——物理隔离、数据驻留、单位成本——那就在下载的那一刻把三份一起快照下来,放在摘要旁边,理由见钉版本与校验。
轴是「标准 vs 定制」,不是「宽松 vs 严格」。
工程师习惯按「允许了多少」来给许可证排序。对一个智能体团队来说,更有用的排序方式是「要花多少工夫才能知道自己站在哪儿」,因为这份成本会在每一次换模型、每一次进新市场时重新发生。一份标准许可证已经被成千上万名律师读过,而且没有任何条件指向你;一份定制协议是由单一对手方起草的合同,其中的条件可能在你的业务每次换形状时都需要重新过一遍法务。
# Two questions, in the order that decides the answer Q1 Is this a standard, unmodified OSI licence (Apache-2.0, MIT, BSD) with no rider? yes -> clear once, per licence, forever no -> continue Q2 Do any conditions reference facts about the LICENSEE rather than facts about the USE? (user counts, headquarters, sector, affiliates) yes -> re-clear on every business change no -> clear once, per model # Landscape as of late 2026 Apache-2.0 Qwen3 and later, Gemma 4 (Apr 2026), gpt-oss MIT DeepSeek R1 and V3/V4 checkpoints bespoke Llama 4 Community License
2026 年的两处变化,让这件事成了一个活的问题而不是一个已经定案的问题。Google 在四月把 Gemma 4 转到了 Apache 2.0,让此前管着 Gemma 3 及更早版本的「源码可得」式 Gemma 使用条款退场;阿里从 Qwen3 起把 Qwen 系列以 Apache 2.0 发布;OpenAI 的 gpt-oss 以 Apache 2.0 发布并附带一份使用政策。Meta 是那个显眼的例外,而这件事对「你接下来要部署什么」的影响,远不如对「你在 2024 和 2025 年部署了、之后再也没回头看过的那些东西」的影响大。
Apache 2.0 与 MIT 不能互换,而这处差别是整个话题里唯一纯粹属于法律的一处。Apache 2.0 含有贡献者的明示专利授予,以及一条「你若就此起诉他们则授权终止」的条款;MIT 对专利只字未提。如果你是在交付一款产品而不是在做实验,那么在两者都有的情况下,这份专利授予就是优先选 Apache 2.0 权重的理由。
定制条款挂在什么上——以 Llama 4 协议作为范本。
Llama 4 社区许可证值得完整读一遍,不是因为 Llama 格外严苛,而是因为它是「条件针对被许可方而不是针对用途」这一类条款最清晰的标本。其中三条就足以说明整个类别。
- 一条用户数门槛。如果在发布日期之前的那个自然月里,你的产品月活用户超过 7 亿,你就必须向 Meta 申请一份许可,而是否授予由 Meta 全权决定。几乎没人会撞上这条——但请注意它的形状:这是一条你的增长就能违反的条件,条款由对手方裁定,而你在代码里再怎么小心也影响不了它。
- 一条辖区排除。注册地在欧盟的公司与个人不被授予多模态模型的权利,而用这些模型构建的产品的最终用户则不受影响。于是同一份权重会因为部署主体坐在哪里而享有不同的许可,这在你开出一家欧盟子公司的那一刻,就把一个法律问题变成了一个架构问题。这是数据驻留与主权的许可证那一半。
- 署名与命名义务。显示「Built with Llama」、带上版权声明,以及在衍生模型的名字里包含「Llama」。这些遵守起来很便宜、忘掉也很容易,而它们正是最可能被一个「被某人改了名的微调检查点」悄悄违反的条款。
请注意这三条都不是什么:它们都不是对商业使用的限制。定制的模型许可证大多在商业上相当大方,而在针对具体主体上附加条件——这与多数工程师从开源软件那边带来的心智模型恰好相反,在那边,条件是挂在你分发的东西上的。
微调正是义务先被继承、然后被丢失的地方。在一个定制许可的基座上训练出来的 LoRA 适配器,在这些协议的多数条款下都是衍生物,于是命名规则、AUP 和辖区排除全都跟着它走——包括跟进那个「没人记下基座是什么」的内部模型注册表里。如果你的注册表存了一个检查点却没存它的血缘,你日后就无从回答这个问题;这份记录属于智能体供应链安全的一部分,而不是另一件杂活。
每个模型记四件事,这个问题就变得可回答了。
实际要上的控制并不大。对每一套你在跑的权重,在摘要旁边存四件事,合规问题就不再需要每次被问到时都找一位律师。
# One record per deployed checkpoint licence SPDX id, or "bespoke" + local copy of the text aup URL + retrieval date + local copy outputs may we train on this model's outputs? y/n/unclear lineage base model + digest, recursively # Derived once, re-derived only on business change exposure which bespoke conditions could our growth, our jurisdictions or our sectors violate?
- 在能力接近时优先选标准许可证。最好的 Apache 2.0 或 MIT 开放权重模型与最好的定制许可模型之间的差距,已经收窄到对大多数智能体负载来说,许可证是一个正当的决胜项、而不是一种牺牲。请在选择模型时把它明确计分,而不是在上线评审时才发现它。
- 去审计你已经上线的模型,而不是你正在挑的那些。选型环节会得到法务关注;从 2024 年起就在静静服务生产的那个检查点不会。没记下的血缘和没做到的命名义务就住在那儿。
- 不要让「开放」替你做论证。开放权重买来的是物理隔离、驻留控制,以及一份归你自己的单位成本——理由见小模型与本地模型与自托管推理。它们买不来「摆脱一个对手方」,而一份定制许可证会让对手方无限期地留在画面里,这与第三方模型与厂商风险是同一条风险登记项。
- 把 AUP 当成一个会动的依赖。定期 diff 它。在这件事里,它是唯一能在一个你已经部署、并且已经按摘要钉住的模型底下发生变化的部分。