开源不等于免费商用
开源大模型常被误解为“完全免费”,但许可证才是法律边界。许多模型虽公开权重,却通过附加条款限制商业用途、要求署名或强制衍生作品开源。开源许可证种类繁多,权利与义务差异巨大。商业公司若忽视这些条款,可能面临法律与声誉风险。
许可证收紧的典型路径
从宽松的Apache 2.0、MIT,到带有限制的社区许可证,再到禁止某些商业场景的自定义协议,收紧方式多样。常见限制包括:月活跃用户超过阈值需申请授权、不得用于训练竞争模型、必须公开微调后的权重等。部分许可证还要求披露训练数据来源或限制生成内容的用途。
- 使用范围限制:仅限研究或非商业目的。
- 传播义务:衍生模型需采用相同许可证。
- 商业授权门槛:达到一定规模需付费或单独谈判。
“搭便车”为何越来越难
模型开发成本高昂,社区希望商业使用者回馈生态。许可证收紧正是为了遏制“只取不予”的行为。同时,监管对AI透明度和版权合规的要求也在提高,企业无法再假装看不见许可证。商业公司若将模型集成到SaaS产品中,往往触及限制条款。
商业公司面临哪些风险
未经授权将开源模型用于商业产品,可能触发许可证终止、诉讼或被迫开源。即使最终胜诉,法律成本和产品下架风险也不容忽视。此外,投资者和客户对合规问题的审查日益严格。合规团队需要评估下游客户的使用方式是否超出许可范围。
合规使用仍有机会
企业可以优先选择Apache 2.0等宽松许可证的模型,或主动联系模型方获取商业授权。参与开源社区、贡献代码和数据,也有助于获得更友好的许可条件。关键在于建立内部许可证审查流程。对于关键业务,自研模型或购买商业授权可能是更稳妥的选择。同时,保留许可证文本和合规记录,以备审查。
开源生态的再平衡
许可证收紧并非封闭,而是试图在开放与可持续之间寻找平衡。商业公司若能尊重规则、积极回馈,仍可享受开源红利。社区也在探索分级许可,针对不同规模使用者设定不同义务。这种再平衡需要模型方、使用者和监管方共同参与。未来,“免费搭便车”将让位于“合规共建”。