一般决议:Debian中的LLM使用

Lobsters Hottest 新闻

摘要

Debian正在举行一项一般决议,以决定是否禁止使用LLM或生成式AI做出的贡献,理由是版权和质量问题。

<p><a href="https://lobste.rs/s/ygobr3/general_resolution_llm_usage_debian">评论</a></p>
查看原文
查看缓存全文

缓存时间: 2026/07/25 18:06

# 关于在Debian中使用大型语言模型的通用决议 来源:https://www.debian.org/vote/2026/vote_002 - 时间线(https://www.debian.org/vote/2026/vote_002#timeline) - 提案A提议者(https://www.debian.org/vote/2026/vote_002#proposera) - 提案A附议者(https://www.debian.org/vote/2026/vote_002#secondsa) - 提案A(https://www.debian.org/vote/2026/vote_002#texta) - 提案B提议者(https://www.debian.org/vote/2026/vote_002#proposerb) - 提案B附议者(https://www.debian.org/vote/2026/vote_002#secondsb) - 提案B(https://www.debian.org/vote/2026/vote_002#textb) ### 时间线 讨论期:2026\-07\-24 ### 提案A提议者 Matthias Geiger \[[werdahias@debian\.org](mailto:[email protected])\] \[提案文本 (https://lists.debian.org/debian-vote/2026/07/msg00117.html)\] ### 提案A附议者 1. Johannes Schauer Marin Rodrigues \[[josch@debian\.org](mailto:[email protected])\] \[邮件 (https://lists.debian.org/debian-vote/2026/07/msg00001.html)\] 2. Antoine Le Gonidec \[[vv221@debian\.org](mailto:[email protected])\] \[邮件 (https://lists.debian.org/debian-vote/2026/07/msg00002.html)\] 3. Simon Richter \[[sjr@debian\.org](mailto:[email protected])\] \[邮件 (https://lists.debian.org/debian-vote/2026/07/msg00005.html)\] 4. David Bremner \[[bremner@debian\.org](mailto:[email protected])\] \[邮件 (https://lists.debian.org/debian-vote/2026/07/msg00088.html)\] 5. Pierre\-Elliott Bécue \[[peb@debian\.org](mailto:[email protected])\] \[邮件 (https://lists.debian.org/debian-vote/2026/07/msg00092.html)\] 6. Ian Jackson \[[iwj@debian\.org](mailto:[email protected])\] \[邮件 (https://lists.debian.org/debian-vote/2026/07/msg00122.html)\] 7. Amin Bandali \[[bandali@debian\.org](mailto:[email protected])\] \[邮件 (https://lists.debian.org/debian-vote/2026/07/msg00135.html)\] ### 提案A ### 选项1 #### 序言 本提案旨在明确禁止任何使用或借助大型语言模型(LLMs)或其他生成式人工智能工具撰写的对Debian的贡献。 本通用决议的范围(非详尽)包括: - Debian源代码包 - 官方Debian项目软件,例如lintian - Debian网络资源 - 由Debian贡献者添加的文档和翻译 - 来自Debian的官方通信 不包括: - 使用LLM进行开发的上游项目 - 与AI相关的软件 - 上游补丁/安全修复等 #### 理由 Debian以其稳定性赢得了良好声誉。这种稳定性对于Debian在自由软件生态系统中的地位至关重要。我们相信,广泛使用LLM源于“快速行动,打破常规”的态度,这种态度虽然在行业的许多部分很常见,但与Debian之所以成为Debian的理念背道而驰,并且对Debian贡献者来说是不合适的。 实际上,LLM的使用引发了以下担忧: ##### 1. 版权 LLM输出的法律地位非常不明确:它可能本身具有版权,也可能没有;它可能受到训练数据中所有许可和版权的影响,也可能不受影响。Debian政策(Policy)和DFSG要求许可和版权完全清晰\[1\]\[2\]。通常由人类以传统方式撰写但版权或许可状态不明确的软件及其他贡献不允许进入Debian;LLM输出不应在这方面享有特殊例外。 ##### 2. 质量 众所周知,LLM输出存在准确性问题。\[3\]\[4\]\[5\] LLM永远无法“知道”其输出是否正确,因为它仅仅产生训练数据中句法上可能的组合。在某些环境中,这已经足够好。但在Debian中则不然。例如,在打包方面,每个Debian源代码包都是独特的。由于打包语法和最佳实践随时间变化,LLM生成的包将包含跨越整个档案年龄的混合内容,包含无法正常工作的watch文件、不合时宜的覆盖、虚构的版权,并且通常不适合上传。一位经验丰富、具备打包专业知识的Debian贡献者可能会发现其中有限的用处,但新贡献者不能,也不会知道如何修复。同样的质量和准确性问题显然适用于本提案上述范围内列出的所有领域。如果Debian是一个由永不离开的领域专家组成的封闭组织,这可能不是问题;然而, ##### 3. 社区 Debian不仅仅是一个代码项目:它是一个建立在自由软件和解决技术问题共同兴趣之上的社区。Debian有意通过多种方式发展这个社区,并且始终鼓励新的贡献者加入。允许LLM贡献会破坏这一点。新贡献者提交LLM输出供审查给审查者带来了不必要的压力,可能导致倦怠。此外,依赖LLM的新贡献者实际上并没有学习和理解Debian打包或流程的细节,因此他们无法接替一位已经倦怠的DD。 ##### 4. 伦理 LLM公司通过无视许可、版权甚至诸如robots.txt等既定惯例,抓取整个网络作为训练数据,直接损害了整个自由软件社区。\[6\] 这对Debian的公共网络资源产生了重大的负面影响,实际上对许多用户依赖的站点实施了大规模且永久的拒绝服务攻击。结果,我们部分基础设施根本无法访问,并且不得不启用基于JS的检查。许多其他项目也受到了类似影响。此外,LLM训练消耗了惊人的资源\[7\],而我们被迫实施作为保护的用户验证系统也在浪费资源。这是对作为公共资源的互联网的公然漠视,浪费了系统管理员的时间,尽管单个LLM会话不会直接消耗大量资源或对公共网络进行DoS攻击,但LLM能够被使用这一事实本身就是LLM公司这些不道德行为的直接结果。 Debian有一套社会契约。\[8\] 我们的优先事项是我们的用户和自由软件。Debian是稳定的。\[9\] 用户和组织选择Debian是因为它可靠且安全。 Debian的存在不是为了产生尽可能多的代码而需要数量日益减少的人类志愿者进行手动审查,也不是为了打包每一个软件,或匆忙推出新功能,但这些正是LLM的用途。 总之,允许LLM贡献与社会契约以及创建一个注重质量和稳定的自由操作系统的共同事业背道而驰。 #### 提案 为了不损害Debian的声誉或进一步损害社区,应禁止将LLM辅助的贡献纳入Debian。 虽然我们认为LLM贡献与Debian已经批准的文档相矛盾,但为了消除所有疑虑,我们建议在社会契约中增加以下内容: `` 6. 通过使用大型语言模型(LLM)创建的作品 我们不允许 直接贡献给Debian的、使用或借助大型语言 模型(LLM)或其他生成式AI工具撰写的内容。直接贡献 定义为打包、原生Debian软件(如lintian)、由Debian贡献者撰写的文档和 翻译,以及官方Debian网络资源等。其他类别,如使用LLM辅助撰写的上游项目, 可能会在日后被纳入。这确保了Debian保持为一个稳定、可信、 可靠的操作系统,并保护了使其成为可能的Debian 志愿者的利益。 `` #### 可能的问题 其他探索类似决定的项目曾引发一个常见的回应:“你们将如何执行对LLM贡献的禁令?” 虽然执行可能具有挑战性,但这是Debian社区意图的声明,我们相信这个社区会本着诚信遵守它。 #### 引用 \[1\] https://www\.debian\.org/doc/debian\-policy/ch\-archive\.html\#copyright\-considerations \[2\] https://www\.debian\.org/social\_contract\#guidelines \[3\] https://web\.archive\.org/web/20240614004123/https://news\.northeastern\.edu/2023/11/10/ai\-chatbot\-hallucinations/ \[4\] https://web\.archive\.org/web/20250328154700/https://transformer\-circuits\.pub/2025/attribution\-graphs/biology\.html\#dives\-cot \[5\] https://www\.marketwatch\.com/story/openais\-sam\-altman\-tells\-salesforces\-marc\-benioff\-that\-ai\-hallucinations\-are\-more\-feature\-than\-bug\-1c035c52 \[6\] https://lwn\.net/Articles/1008897/ \[7\] https://tech\-insider\.org/ai\-data\-center\-power\-crisis\-2026/ \[8\] https://www\.debian\.org/social\_contract \[9\] https://www\.debian\.org/doc/manuals/debian\-reference/pr01\.en\.html\#\_what\_is\_debian #### 免责声明 - 引用仅用于背景信息,并不代表对特定网站的认可。 - 部分想法和措辞源自以下来源。 #### 来源 GNOME讨论:https://discourse\.gnome\.org/t/loupe\-no\-longer\-allows\-generative\-ai\-contributions/27327 (CC0) Gentoo AI政策:https://wiki\.gentoo\.org/wiki/Project:Council/AI\_policy Codeberg AI政策:https://codeberg\.org/Codeberg/org/pulls/1253\#issuecomment\-19820434 本文档由Matthias Geiger和Jesse Rhodes在Sledge和josch的协助下撰写,为原创性创作,未使用语言模型辅助。 ### 提案B提议者 Lucas Nussbaum \[[lucas@debian\.org](mailto:[email protected])\] \[提案文本 (https://lists.debian.org/debian-vote/2026/07/msg00018.html)\] \[修正案文本 (https://lists.debian.org/debian-vote/2026/07/msg00048.html)\] \[修正案文本 (https://lists.debian.org/debian-vote/2026/07/msg00083.html)\] ### 提案B附议者 1. Andrey Rahmatullin \[[wrar@debian\.org](mailto:[email protected])\] \[邮件 (https://lists.debian.org/debian-vote/2026/07/msg00019.html)\] 2. Christian Kastner \[[ckk@debian\.org](mailto:[email protected])\] \[邮件 (https://lists.debian.org/debian-vote/2026/07/msg00028.html)\] 3. Anton Gladky \[[gladk@debian\.org](mailto:[email protected])\] \[邮件 (https://lists.debian.org/debian-vote/2026/07/msg00032.html)\] 4. Stefano Zacchiroli \[[zack@debian\.org](mailto:[email protected])\] \[邮件 (https://lists.debian.org/debian-vote/2026/07/msg00040.html)\] 5. Simon Quigley \[[tsimonq2@debian\.org](mailto:[email protected])\] \[邮件 (https://lists.debian.org/debian-vote/2026/07/msg00091.html)\] 6. Soren Stoutner \[[soren@debian\.org](mailto:[email protected])\] \[邮件 (https://lists.debian.org/debian-vote/2026/07/msg00093.html)\] 7. Julian Andres Klode \[[jak@debian\.org](mailto:[email protected])\] \[邮件 (https://lists.debian.org/debian-vote/2026/07/msg00104.html)\] ### 提案B ### 选项2 #### 允许AI辅助贡献 项目依据章程第4.1条第(5)款之权力,发布以下声明,描述其对AI辅助贡献的当前立场。本声明描述了项目在采纳时的立场。随着时间推移,该立场可能会演变,无需诉诸未来的通用决议。如果项目需要做出决定但无法达成共识,通用决议流程仍可使用。 Debian项目认识到AI辅助贡献引发了许多担忧,例如关于此类贡献的技术质量、可维护性及其法律地位。AI本身也引发了额外的担忧,涉及对整个社会、IT行业和自由软件的影响;其环境影响;以及AI爬虫的激进或不合规做法。 尽管如此,许多Debian贡献者发现AI工具有助于他们为Debian做出贡献,并最终有助于改进Debian。 鉴于AI辅助的好处和风险,以及社区内的争议性讨论,Debian项目认为有必要澄清其对AI辅助贡献的立场,并建立明确的指导方针。 Debian项目允许AI辅助贡献(部分或全部由LLM生成),前提是满足以下条件: 1. **工具法律兼容性:**贡献者应确保生成式AI工具的条款和条件不会施加与在Debian背景下分发、修改或使用输出相冲突的合同限制。 2. **许可与归属:**如果AI工具的输出中包含任何由第三方创作或拥有的既有版权材料(包括以自由软件许可的既有代码),在向项目提交此类输出之前,贡献者应核实其有权根据相关的开源许可提交该材料。 3. **责任归属:**贡献者对其贡献承担全部责任,包括为其提交的内容的技术价值、安全性、许可合规性和实用性作担保。贡献者对这些贡献的全部内容负唯一责任。贡献者应充分理解所建议的更改,并准备好对其合理性进行论证。 4. **披露:**当贡献的重大部分由工具生成或得到实质性协助时,贡献者应披露该工具的使用情况,使其对目标受众清晰可见。这涵盖所有形式的贡献,包括代码、邮件列表帖子和bug讨论。披露形式由贡献者自行决定;一种便捷的方式是在提交信息中使用Git尾注,如Generated\-By: 或 Assisted\-By:。 5. **批量或自动化更改的事先讨论:**与批量提交bug流程(开发者参考第7.1.1节)类似,贡献者在提交批量或自主生成的贡献之前,应讨论其意图。任何此类自动化过程应由一位人类监督,该人类对其行为和输出负责。 6. **保密与隐私:**贡献者不得使用将非公开或敏感的项目信息(如处于禁言期的安全报告或私人通信)传输给不可信提供者的生成式AI工具,因为这可能导致机密数据的意外泄露。 --- [Debian项目秘书长](mailto:[email protected])

相似文章

NLNet Labs LLM 政策

Lobsters Hottest

NLNet Labs 宣布了一项限制在代码和文档贡献中使用 LLM 的政策,要求披露 LLM 的使用情况,并禁止 AI 生成的代码。

依赖中无LLM代码

Hacker News Top

git-annex 维护者详细介绍了移除包含LLM生成代码的依赖项的努力,表达了对代码质量和伦理影响的担忧。

应禁止LLM生成的提交内容

Lobsters Hottest

Lobsters上的一位用户提议应禁止LLM生成的提交内容,认为应封禁发布此类内容的用户,并添加通知提醒提交者。