如何看懂开源模型许可证
选模型第一件事不是看跑分,是看许可证。用大白话讲清楚 Apache-2.0、Llama、CC-BY-NC 等常见开源模型许可证的区别与商用红线。
许可证开源模型商用合规
如何看懂开源模型许可证
选模型第一件事不是看跑分,是看许可证。这篇文章用大白话讲清楚常见开源模型许可证的区别。
** TL;DR **
- Apache-2.0 / MIT / BSD:闭眼用,商用友好,保留版权声明即可
- Llama 系列 / Gemma:可以商用但有额外条款(月活限制、命名要求等),用前读一遍
- CC-BY-NC 系列:明确禁止商用,公司项目别碰
- 未声明:默认所有权利保留,等于不能用
为什么许可证这么重要
很多团队在技术选型时只看模型效果,上线产品后才发现许可证不允许商用,被迫紧急换模型重训。 许可证决定了:你能不能把模型放进商业产品、要不要开源你的下游代码、能不能修改后闭源分发。
四类常见许可证
1. 宽松型(Apache-2.0、MIT、BSD-3)
Qwen、DeepSeek 大部分模型用 Apache-2.0。这是最省心的一类:
- ✅ 商用、修改、分发、私有问题都没有
- 唯一义务:分发时保留原许可证和版权声明
- Apache-2.0 还附带专利授权条款,比 MIT 更完整
2. 有条件型(Llama 3 Community License、Gemma Terms)
Meta 的 Llama、Google 的 Gemma 属于这类。可以商用,但附带你必须遵守的条款,例如:
- Llama 3:月活超过 7 亿的产品需要向 Meta 申请特别许可
- 命名要求:衍生模型名里要包含 "Llama"(如 "XXX-Llama-8B")
- 部分用途被明确排除(比如用于训练竞品模型)
用之前把许可证原文过一遍,重点看 "Additional Use Restrictions" 一节。
3. 非商用型(CC-BY-NC-4.0、research-only)
常见于学术机构发布的模型。个人学习、研究没问题;任何商业用途(包括内部商用工具)都被禁止。
4. 未声明
模型卡片上没写许可证 = 默认版权所有,法律上你不能使用。提 issue 问作者,或者干脆换一个。
本站怎么帮你
每个收录条目我们都标注了许可证原文标识和四档商用分组(✅可商用 / ⚠️受限 / ❌非商用 / 未知), 数据来自 HuggingFace Hub API 的模型卡片,并有校验时间。筛选时直接用「许可证」维度过滤,先把法务问题解决掉再谈技术。
免责声明:本文是通俗科普,不构成法律意见。商用前请阅读许可证原文,必要时咨询律师。