开源协议
开源协议是规范开源软件与开源大模型使用、修改与分发权利的法律安排。开源软件通过开源许可证向公众开放源代码,允许任何人使用、修改与再分发,其定义由开放源代码促进会(OSI)依据《开源定义》加以界定——凡未经 OSI 批准的许可证,按定义即不属于开源许可证[^c1]。开源许可证总体上分为宽松许可证与 copyleft 两大类:宽松许可证施加最少限制,允许代码被用于专有项目[^c2];copyleft 许可证则要求再分发(尤其是修改版)时以相同许可证发布衍生作品[^c3]。
开源运动源于对 UNIX 私有化的回应,脱胎于自由软件运动。1998 年,一群对"自由软件"一词所隐含的政治与道德立场持批评态度的人提出了"开源"这一术语[^c4],开放源代码促进会随后成立。几十年来,开源软件成为现代数字基础设施的骨干,主流的 Web 服务器、数据库系统都运行在 Linux 之上[^c5],开源也由此从边缘走向主流。
大模型时代的到来给开源许可带来了新的挑战。AI 模型的知识产权不仅体现在源代码中,还涉及训练数据、处理流程、权重与配置[^c6],开源 AI 的定义因此成为争议焦点。OSI 于 2024 年 10 月发布了《开源 AI 定义》(OSAID)[^c7],而 Llama、通义千问、DeepSeek 等主流模型采用了从 MIT、Apache 2.0 到各类社区许可证的多样化许可安排,其中只有少数模型符合 OSI 的开源定义[^c8]。与此同时,源可用(source-available)许可证的兴起也在软件领域重新划定了开源边界。这一趋势最早可追溯至 2018 年的 Commons Clause——由 Heather Meeker 起草的许可条件,叠加在既有开源许可证之上以将项目转变为源可用许可安排[^c16]。此后商业源许可证(BSL)允许任何人查看代码或用于内部与测试目的,但商业使用受到限制[^c12];Redis 于 2024 年 3 月宣布 7.2.4 之后的新版本不再以 BSD 发布,改为 RSALv2 与 SSPLv1 双重许可[^c13]。这类安排引发了持续的开源定义之争。
到 2026 年,开放权重模型与闭源前沿模型的差距进一步收窄,其政策地位与经济价值成为全球焦点。开源模型可以被任何人自由使用并在此基础上继续开发[^c10]。尽管开放模型在广泛使用的基准上通常能达到闭源模型 90% 以上的性能,闭源模型仍占据约 80% 的模型使用量与 96% 的收入,而其平均成本是竞争性开放模型的六倍[^c11]。2026 年 7 月,OpenAI 与 Anthropic 在华盛顿游说限制中国开源模型,而英伟达、微软、Meta 等 25 家科技公司签署公开信支持开放权重模型,随后 OpenAI 等加入、签署方增至 50 家[^c9],围绕开源定义的争论由此从技术领域蔓延至国家安全与产业竞争层面。在生态层面,中国开源大模型已占据显著位置:通义千问系列模型累计下载量突破 10 亿次[^c14],中国开源模型在 Hugging Face 上的月下载占比已达 41%,首次超越美国[^c15]。2026 年年中,中国开放权重模型的迭代进一步加速:智谱 AI 的 GLM-5.2 以 MIT 协议开源并登陆 OpenRouter[^c17],月之暗面发布了当时全球参数规模最大的开源模型 Kimi K3(2.8 万亿参数)[^c18],阿里巴巴亦宣布其旗舰模型 Qwen3.8 将以开放权重形式发布[^c19]。Kimi K3 是首个达到 2.8 万亿参数规模的开源模型[^c20]。8 月,开源浪潮进一步升温:DeepSeek 于 7 月 31 日以 MIT 许可证开源生产版 V4-Flash[^c22];8 月 3 日阿里巴巴正式发布总参数 2.4 万亿的 Qwen3.8 并宣布开源 Qwen3.8-Max 与 Qwen3.8-27B;8 月 13 日 DeepSeek V4 Pro 正式版上线、阿里首次开放 Max 级别旗舰权重。据 Hugging Face《2026 年春季全球开源 AI 生态报告》,中国开源模型累计下载量突破 100 亿次[^c21]。Google 的 Gemma 4 亦在这一轮改用 Apache 2.0,放弃了之前备受争议的限制性条款[^c25]。
数据层面,Apache 2.0 已取代 Llama 自定义社区许可成为开放权重模型的主流许可:据 Hugging Face 2026 年春季报告,在 Hub 排名前 1000 的模型中 71.5% 采用宽松开源协议,其中 Apache 2.0 占 49%、MIT 占 19.8%[^c27];2026 年发布的超过 200 亿参数的中国模型中,亦有约六成采用 Apache 2.0、约两成采用 MIT[^c28]。与此同时,围绕"开源"标签的边界之争也在模型厂商的许可改动中持续上演——2026 年 4 月,MiniMax 将旗舰模型的许可从标准 MIT 改为"修改版 MIT",在继续使用开源标识的同时限制所有商业用途,招致海外社区强烈批评[^c29]。
与此同时,"开源"的边界与商业安排也在同步演变。Kimi K3 的许可证首次在主流模型中引入面向大型"模型即服务"商家的收入分成条款——以服务形式销售模型且年销售额超过 2000 万美元的用户需与月之暗面签订商业协议[^c24],阿里巴巴亦计划对 Qwen3.8-Max 采取类似机制。在许可框架层面,Linux 基金会于 2026 年 5 月发布 OpenMDW-1.1,作为专门面向 AI 模型分发的宽松许可框架[^c23],标志着模型专属许可证标准化进程的启动;OSI 则在联合国开源周上启动开源 AI 研究员计划,继续围绕开源 AI 的定义开展研究、政策与实践建设[^c26]。