Hyaika Blog

Penguin is all you need

技术

同一个 AI,开源世界的四种答案

同一个 AI,开源世界的四种答案

同一个 AI,开源世界的四种答案

目录

  • 四个答案,两年半
  • Gentoo 的答案是「禁」:2024 年第一份 AI 禁令
  • Debian 的答案是「等」:从否决到通过,用了两年
  • QEMU 的答案是「证」:让代码自己说话
  • F-Droid 的答案是「调」:一边效仿,一边另起炉灶
  • 现场验证:门口的黑名单
  • 政策追不上工具

四个答案,两年半

如果把「开源社区怎么对待 AI 贡献」当成一道选择题,目前交卷的四个社区,答案没有一个是重复的:Gentoo 说禁,Debian 说等,QEMU 说证,F-Droid 说调。

最新一份答卷来自 F-Droid。2026 年 9 月,开源安卓应用商店在 GitLab 挂出《生成式 AI 临时使用政策》提案,声明要「效仿 Debian」。这四个字拆开读平平无奇,合起来却有点魔幻——Debian 在这个问题上,是先花了两年时间否决一份禁令,再投票通过一份「既不支持也不禁止」的声明。而 F-Droid 要效仿的,正是这份改过主意的产物。

Gentoo 的答案是「禁」:2024 年第一份 AI 禁令

最早的明确答案来自 Gentoo。

2024 年 4 月 14 日,Gentoo Council 投票通过了一份政策,措辞几乎没有任何回旋余地:

「明确禁止向 Gentoo 贡献任何借助自然语言处理人工智能工具创建的内容。若有人能证明某种工具不构成版权、伦理和质量方面的担忧,本动议可重新审议。」

理由列了三条:版权归属仍在世界各地萌芽、流行的 LLM 擅长生成「看起来合理但毫无意义」的内容、以及 AI 热潮的商业面正在制造严重的伦理问题(训练中的版权侵权、能源和水的消耗、垃圾信息和诈骗的规模化)。

注意第一条:版权归属仍在世界各地萌芽。Gentoo 的担心不是「AI 写的代码烂」,而是「AI 写的东西到底算谁的」——这直接影响 Gentoo 对项目代码的所有权主张和 copyleft 许可的保证。一份 2024 年的政策,预判了 2026 年才集中爆发的版权争议。

Gentoo 的禁令甚至没有打算仁慈:它不禁止「打包 AI 相关的软件」,只禁止「用 AI 工具产出来贡献」。一个做 LLM 基础设施的发行版,可以分发 LLM 推理框架,但它的维护者不能用 LLM 写代码进仓库。这个分寸感很有意思。

Debian 的答案是「等」:从否决到通过,用了两年

Debian 走的是完全不同的路。

2024 年 5 月,Debian 开发者 Tiago Bortoletto Vaz 在邮件列表发起讨论,建议项目考虑采用 AI/ML 工具使用政策,并援引 Gentoo 的禁令。

结果是一场教科书级别的「社区共识测试」。有人支持:Charles Plessy 说商业 AI 是「版权洗钱机器」,会投赞成票反对「用商业 AI 生成 Debian 打包、原生或基础设施代码」。但更多人是怀疑派:

Russ Allbery 直言 Gentoo 的禁令「如他们自己承认的那样,无法执行」。「我们不针对人们本地开发用什么工具制定政策」,他说。他更担心的是实际影响:「大部分输出是低质量垃圾,而且因为是自动化的,低质量垃圾的量可以非常大。」但他仍然反对立规——「我们已有足够的机制来投诉和要求停止,不需要新政策」。

还有人从维护者信任的角度反驳:Sam Hartman 说,「作为申请管理员,如果一个申请人用 LLM 还不告诉我,这本身就违反信任。我不需要政策就能得出这个结论。」

这场讨论在 5 月 8 日结束。Vaz 承认「离官方立场达成共识还差得远」,希望「在我们更好地理解这一切的后果时」再重新讨论。LWN 的总结是:Debian 采取保守观望,因为 AI 内容带来的问题「还没痛苦到足以推动禁令或具体政策」。

然后,2026 年 8 月 29 日——两年零三个月之后——Debian 的全体决议投票结果公布。胜出的是选项 5:《负责任地使用生成式 AI》。

核心措辞很有意思:

「Debian 既不支持也不禁止在软件开发、维护或文档工作中使用生成式 AI 工具。我们认识到,负责任地使用这些工具可以大幅提高贡献者的生产力,让志愿者把有限时间花在更需要技术专长、判断、审查和协作的工作上。但无论用什么工具产出,所有提交给 Debian 的内容都必须满足同样的质量标准……使用生成式 AI 工具不减轻贡献者对提交内容的责任。」

注意这个结果背后还有一个细节:两个全面禁 AI 的提案(选项 1 和 3),投票数甚至低于「None of the above」(以上皆非)。Debian 不仅选了中间路线,还明确拒绝了极端路线。

2024 年众人担心的「无法执行」,最终成了选择中间路线的理由——与其立一个执行不了的禁令,不如立一个能执行的「责任声明」。

F-Droid 的答案是「调」:一边效仿,一边另起炉灶

现在回到 2026 年 9 月 F-Droid 的提案。

它的临时政策几乎逐条对应 Debian 2026 年的方案:不禁止贡献者使用生成式 AI;所有提交内容由人类贡献者承担最终责任;不试图解决版权归属等法律争议,要求贡献者自行判断;鼓励(但不强制)披露是否使用了 AI。

但 F-Droid 有一点是 Debian 没有的:它同时还要回答「AI 应用要不要被收进仓库」这个问题。临时政策只适用于 F-Droid 项目本身的开发流程——至于第三方开发者用 AI 做的 app 能不能进 F-Droid,是「另行讨论」的另一件事。

为什么这块更难?因为 F-Droid 的立身之本就是「自由软件商店」——它对 app 有一套成熟的反特性(Anti-Features)标注体系:广告、非自由网络服务、已知漏洞、追踪……每一款收录的应用都要过一遍自由度和隐私审查。而 AI 功能恰好把「自由」这个概念本身撕开了一个口子:

  • 一个 app 用「云端 AI」但数据全在本地,算不算自由?
  • 一个 app 的二进制是「可复现构建」的,但它的 AI 模型权重却不是自由许可证,算不算非自由资产?
  • 一个用 AI「vibe coding」写出来的 app,代码到底该归谁?训练数据里的许可证冲突会不会传导到产物?

2025 年 9 月,F-Droid 论坛上就有人发起过讨论:「F-Droid 对『自由 AI』有正式政策吗?」帖子里的问题一个比一个尖锐——「生成式模型的产物默认属于公有领域」「如果 AI 产物的版权被主张,作者是否受训练数据中 copyleft 许可的约束?」「训练数据里如果有多个 source-available 许可证互相矛盾,该适用哪个?」这个帖子最后也没吵出结论,53 条回复,大部分是「我们得再想想」。

F-Droid 的处境其实有点像 Gentoo 的镜像:Gentoo 是「分发 AI 工具但不能用 AI 写代码」,F-Droid 是「用 AI 开发没问题,但 AI 做的 app 怎么进仓库还得再吵」。工具的生产和使用,被拆成了两道完全不同的问题。

QEMU 的答案是「证」:让代码自己说话

还有一条路,不是「禁」也不是「等」,而是「让代码自己证明自己」。

2025 年 7 月,QEMU 正式采纳了一项政策:拒绝包含 AI 工具生成代码的贡献。理由不是质量也不是伦理,而是开发者原创证明书(DCO)

DCO 要求贡献者声明「此内容由我创作」。但在许多司法辖区,AI 生成的代码不被承认是受版权保护的作品——「人类作者」在法律上难以成立。而第二个问题更实际:模型在无数种许可证的代码上训练过,没有人能确定生成的代码是不是「干净」的。

QEMU 的选择不是把 AI 拒之门外,而是把「谁能证明这段代码的来源」变成了一道门槛。它没有说「AI 不行」,它说的是「如果你不能用 DCO 保证这段代码的来路,那它就进不来」。

这其实补上了 Gentoo 禁令里最模糊的一块:Gentoo 禁的是「内容」,但内容里到底有没有 AI 的功劳,很难界定。QEMU 把问题换成了「你能证明什么」,而不是「你用了什么」——从动机审查变成了证据审查。

2025 年 10 月,GZDoom 社区因为开发者在代码里掺了 AI 生成内容而分裂;2025-2026 年间,还有更多项目在各自的 issue tracker 里逐条吵。整个开源世界像在同时做同一道选择题,只是交卷时间各不相同。

现场验证:门口的黑名单

写这篇文章的时候,我去看了一眼这几个项目的 robots.txt——就是机器人协议文件,告诉爬虫「你能爬什么」。

各项目 robots.txt 屏蔽 AI 爬虫数量对比

结果很有意思。

F-Droid(政策上「既不支持也不禁止 AI」)的 robots.txt 里,列了 19 个被屏蔽的 AI 相关爬虫:Amazonbot、anthropic-ai、Applebot-Extended、Bytespider、CCBot、ChatGPT-User、Claude-Web、ClaudeBot、cohere-ai、Diffbot、FacebookBot、Google-Extended、GoogleOther、GPTBot、ImagesiftBot、meta-externalagent、Omgili、Omgilibot、PerplexityBot……几乎覆盖了你能叫出名字的所有 AI 训练爬虫。

Gentoo wiki(政策上「禁止 AI 贡献」)屏蔽了 32 个 AI 相关 user-agent,包括 AI2Bot、ChatGPT、Claude-SearchBot、GoogleOther-Image、Meta-ExternalAgent 等。

LWN.net——就是报道了 Debian 两次政策变动的那个新闻站——只屏蔽了 3 个:GPTBot、meta-externalagent、ClaudeBot。

三份政策,三种黑名单长度。最讽刺的是 F-Droid:它的政策文件说「不支持也不禁止 AI」,但它的服务器门口挂的牌子是「AI 爬虫与狗不得入内」。

政策层面「不禁止」,基础设施层面「全屏蔽」——这大概是「用脚投票」最字面的一次。政策要平衡,协议不用:robots.txt 只有 allow 和 disallow,没有「酌情处理」。

政策追不上工具

把时间线摊开看:

  • 2024-04:Gentoo 禁 AI(版权、伦理、质量)
  • 2024-05:Debian 讨论后放弃立规(无法执行、警惕但观望)
  • 2025-07:QEMU 拒绝无法通过 DCO 的 AI 代码(证据门槛)
  • 2025-10:GZDoom 因 AI 代码分裂
  • 2026-08:Debian 投票通过「负责任使用」,两个全面禁令输给「以上皆非」
  • 2026-09:F-Droid 效仿 Debian,立「既不支持也不禁止」临时政策,同时 AI app 收录「另行讨论」

从「禁」到「等」到「让代码证明自己」,开源世界两年半走完了三个立场。这中间没有谁说服谁——Gentoo 没有撤销禁令,Debian 没有转向激进,QEMU 没有松口,F-Droid 还在讨论。它们只是各自选了对自己社区最「可执行」的答案。

有意思的是,所有路线最后都落回同一点:责任在人,不在工具。Gentoo 说「除非你能证明无害」;Debian 说「工具不减轻你的责任」;QEMU 说「你能证明来路就放行」。禁 AI 的、容 AI 的、审 AI 的,最终都在要求同一件事——人类贡献者要对进到仓库里的每一行代码负责。

政策追不上工具,是开源的常态。但它追得上的东西,是「谁负责」。

那句话怎么说来着——AI 不会签 DCO。会签 DCO 的,始终是人。

而这个签名,大概就是自由软件最后一道还没被自动化的工序。

分享:

评论(0)

暂无评论,来写第一条吧~

发表评论