SourceHut服务条款中关于大型语言模型的变更
摘要
SourceHut宣布更改其服务条款以限制使用大型语言模型和生成式AI技术,理由是对开源社区内资源使用和伦理义务的担忧。
<p><a href="https://lobste.rs/s/iqgrsx/changes_sourcehut_s_terms_service">评论</a></p>
查看缓存全文
缓存时间: 2026/08/27 09:41
# SourceHut 关于 LLM 的服务条款变更
来源:https://sourcehut.org/blog/2026-08-27-tos-changes-and-llms/
七月底,Codeberg 宣布将限制在其平台上使用 LLM(大语言模型)(https://blog.codeberg.org/protecting-our-floss-commons-from-llms.html),而 SourceHut 也已就此考虑了一段时间。
上周,我们与 SourceHut 社区(https://lists.sr.ht/~sircmpwn/sr.ht-discuss/%[email protected]%3E)讨论了限制或禁止在 SourceHut 上使用 LLM(大语言模型)及其他生成式 AI 技术的可能性。感谢所有参与讨论、分享各种观点并确保我们能够就此事进行富有成效且文明对话的人士。在这次讨论及后续内部讨论之后,我们决定推进服务条款的必要变更。
我鼓励您阅读此讨论帖,以了解 SourceHut 社区对这一问题(无论支持还是反对变更)所提出的各种深思熟虑的意见。总而言之,SourceHut 社区广泛支持在本平台上限制使用 AI。然而,最终这一决定由工作人员做出,因此我们将专注于阐述我们自身的理由、新政策将如何解释和执行的示例、变更的预期时间表,以及受变更影响的人们如何推进其项目。
=> 点击此处跳过背景介绍,直接阅读变更内容(https://sourcehut.org/blog/2026-08-27-tos-changes-and-llms/#changes)
我们有实际动机去限制 SourceHut 上的“氛围编程”项目。总的来说,这类项目在资源使用方面往往是异常值,因为这种做法往往会创建复杂的 CI 配置,浪费构建时间,产生更大的代码库,并频繁推送提交,所有这些都会导致资源过度使用,并可能引发停机。通常,这些代码库在耗尽所有资源却一无所获后就被废弃了。当然,LLM 爬虫横扫互联网给我们的系统管理员带来更多停机和头痛问题,而 AI 也使我们运行平台以及您使用平台所需的硬件成本飙升。但说实话,理由更多地关乎政治和伦理。
决定“坚守哪些阵地”是件棘手的事。我们是一个在政治上透明的组织,不仅承认我们像所有人一样*拥有*政治立场,也公开我们的政治主张。但是,尽管世界动荡不安,要求我们所有人采取行动,但许多我们坚信的问题未必需要指导 SourceHut 的政策。如果我们根据我们在例如巴勒斯坦问题上的价值观来制定政策,这只会激起争议,增加我们的工作量,却无助于实质性地解决该问题。我们缺乏足够的文化和知识背景来知道如何处理那种情况,而且我们掌握的、能够明智审慎地指导我们政策的资源也十分有限。
然而,在 AI 的案例中,尽管它涉及复杂的社会、经济和政治因素,其中许多超出了我们的专业范围,但它与我们作为专家的领域高度重叠——例如软件开发、开源和开放文化。作为专家,我们更容易认识到,我们有义务评估其影响,并据此发表意见和做出决策。
如果我们狭隘地关注 LLM 如何影响我们的社区,可以参考我们的使命宣言:
> 我们在此致力于让自由软件变得更好。我们将诚实、透明、富有同理心。我们关心我们的用户,不会剥削他们,并希望他们能以成功回报我们的关怀和勤勉。
很难论证 LLM 使自由软件变得更好了。它们运行的方式涉及强行获取(https://codeberg.org/forgejo/discussions/issues/320)且不顾软件作者的意愿、软件许可证的义务(https://spectrum.ieee.org/ai-code-generation-ownership)以及我们工作所依赖的平台,无视许可证要求,获取大量开源软件,并通过对其训练数据进行看似合理重新解读并应用于新问题来“收取租金”以生成代码。在此过程中产生的模型是专有的,由私人公司拥有和控制,回馈给开源社区的甚少。因此,LLM 与开源之间的关系似乎剥削了我们有责任关怀的用户。
我们也目睹了一些其他令人不安的事件,例如利用 LLM 重写开源软件以规避 copyleft 义务,比如 chardet 库(https://github.com/chardet/chardet/issues/327)的案例,这种做法似乎直接违背了开源软件作者的利益。
然而,LLM 也显示出了一些效用。它们能发现真实的错误,包括安全漏洞(https://lwn.net/Articles/1070698/),开源软件因此变得更加健壮。一些程序员(https://lwn.net/Articles/1063292/)发现它们可用于代码审查和其他创造性应用,而且确实有许多程序员报告在使用它们编写或协助编写代码方面取得了良好效果。
但是,当我们视野放得更广时,情况就更令人担忧了。
最大的担忧是对气候的影响。化石燃料驱动的汽车也有用,但大多数人支持提高效率,并最终完全转向电动汽车以减轻其影响。社会为应对气候紧急状况而进行的转型必须是全面的,我们每个人在各自的行业和专业领域,都有道义责任努力减少我们的环境足迹,特别是以系统性和制度性的方式。AI 的推出是一个朝着错误方向发展的巨大趋势。LLM 及类似工具是解决其所应对问题(如编写软件)的**极其**能源低效(https://news.mit.edu/2025/explained-generative-ai-environmental-impact-0117)的方式,并且与缓解气候灾难(https://www.politico.eu/article/europe-choose-ai-climate-goals-data-center-chief-warns/)根本对立。
计划中的 AI 基础设施发展预计将产生相当于整个印度的电力需求(https://newsroom.ucla.edu/stories/opinion-ai-is-destroying-our-planet-we-must-act),而这个国家正因气候变化加剧的热浪而经历数万人死亡(https://www.frontiersin.org/journals/environmental-health/articles/10.3389/fenvh.2026.1789071/full)。这种建设消耗了大量接入电网的绿色能源,推迟了其他领域的脱碳进程(https://www.reuters.com/technology/artificial-intelligence/how-ai-cloud-computing-may-delay-transition-clean-energy-2024-11-21/),或者直接推动了新建化石燃料基础设施的需求(https://www.entergy.com/news/entergy-louisiana-announces-a-new-agreement-with-meta-that-will-deliver-an-additional-2b-in-customer-savings)。无论哪种情况,普通能源消费者往往要为此买单(https://eelp.law.harvard.edu/extracting-profits-from-the-public-how-utility-ratepayers-are-paying-for-big-techs-power/)。
个人层面如何应对气候危机常常不明确。缩短淋浴时间或少用空调可能有所帮助——而富人往往强调这些“解决方案”以转移对其自身影响的责任——但这无法与需要发生的有意义的制度性变革相提并论。
当个人能够掌控那些制度的杠杆时,他们确实能产生影响。作为软件工程师,我们身处部署全球增长最快的能源消耗者之一——AI——的前线(https://energy.ec.europa.eu/news/focus-data-centres-energy-hungry-challenge-2025-11-17_en)。我们的良知呼吁我们抵制那些将加剧数百万人死亡和痛苦的技术的部署。AI 或许能为社会带来益处,但代价如此之高,以至于我们需要仔细权衡其部署方式以及社会收益是否超过这些成本。总体而言,在 SourceHut 及我们社区看来,“氛围编程”所带来的益处不足以抵消其成本。廉价、绿色的电力、淡水资源的保护、呵护我们的星球及其野生动物:这些都远比 AI 辅助编码重要得多。
更广泛的社会和经济后果加剧了这种担忧。这些工具正在颠覆劳动力市场,并加剧本已史无前例的贫富差距。这些公司以最低工资在贫困国家的非人条件下(https://time.com/6247678/openai-chatgpt-kenya-workers/)剥削劳动力来训练模型,而这些模型又可应用于掏空富裕国家的劳动力市场底层。此外,AI 所有者积累的财富和 AI 无产阶级耗尽的资源,进一步被用来巩固权力、助长法西斯主义兴起,并破坏社会秩序与环境秩序。AI 被用于(https://www.aclu.org/news/privacy-technology/palantir-deportation-roundup)未经正当程序驱逐移民、(https://www.aclu.org/news/privacy-technology/machine-surveillance-is-being-super-charged-by-large-ai-models)监视和针对(https://www.oxjournal.org/predictive-policing-or-predictive-prejudice/)贫困和种族化社区、操纵选举和政治话语、大规模(https://www.ohchr.org/en/press-releases/2024/04/gaza-un-experts-deplore-use-purported-ai-commit-domicide-gaza-call)助长反人类罪行,并在我们的制度中放大不公正。
最后,AI 似乎对其使用者本身也有害。许多开源维护者抱怨(https://arstechnica.com/security/2026/01/overrun-with-ai-slop-curl-scraps-bug-bounties-to-ensure-intact-mental-health/)被大量低质量 AI 生成的贡献搞得精疲力竭。AI 已被与“去技能化(https://arxiv.org/abs/2506.08872)”联系起来,使其用户在解决问题和其他认知任务上的能力变差。而且,被聊天机器人诱导至精神病(https://thehumanlineproject.org/research-stanford/)或自杀(https://en.wikipedia.org/wiki/Deaths_linked_to_chatbots#Suicides)的人数持续上升。
这些担忧众多、可信,且要求采取行动。我们对此问题的一个小贡献就是,明确阐述我们在此事上的立场,并调整我们的政策,为那些意识到这些问题的人们提供一个安全的工作和寻找社群的平台。
## 即将到来的变更
新的服务条款将在通常的两周通知期(即9月10日)后对新项目生效,届时在禁止内容列表中将新增以下内容:
- 使用或便于使用 LLM(大语言模型)或其他生成式 AI 技术创作的原创内容
一旦这些条款生效,在 SourceHut 上使用 LLM 或其他生成式 AI 工具来生产或协助生产源代码、资产、工单、电子邮件等将不再被允许。
与其他政策变更一样,我们打算缓慢而审慎地推进。每一个可能的违规行为都将根据具体情况逐案评估,我们愿意做出例外处理。
## 解释问题
这项政策的措辞经过仔细斟酌,为合理的解释留有一定余地。例如,政策中选择针对“原创”内容,旨在允许您托管那些可能拥有更宽松 LLM 政策的主要代码库的镜像,例如 Linux 内核。为 Linux 这样的项目贡献的个人可以在 SourceHut 上托管他们的个人树并暂存补丁,而一个内部 LLM 使用政策与 SourceHut 一致的 Linux 内核子系统也欢迎在我们的平台上托管他们的树、邮件列表等,无需担心 Linux 其他部分中 AI 辅助代码的影响。然而,由于 Linux 项目整体宽松的 LLM 政策,SourceHut 不适合作为其上游托管平台。
此外,对于 AI 用于共同编写代码、工单、电子邮件等以外的目的,我们不鼓励但也不禁止。如果您私下使用 LLM 审阅您的工作、进行提问、执行安全分析等,然后编写原创代码推送到 SourceHut,您的用例符合我们的政策。
一旦此政策生效,包含生成式 AI 功能或直接启用生成式 AI 的软件在 SourceHut 上将不受欢迎。
## 执行
我们打算以温和的方式执行。诚实和透明是我们的核心价值观之一,我们将其延伸至用户,并期望得到同等对待。当我们几乎每天基于需求授予财政援助时,我们依赖荣誉制度,即不要求用户证明其经济状况以获得免费服务。所有用户都根据其能力付费,选择他们能够承担的价格点,从未被要求为其选择提供理由。
因此,在执行方面,首先我们已经明确表态,并表明 AI 辅助项目在 SourceHut 上不受欢迎。我们不会部署任何自动化工具来检测 AI 使用,也不会刻意去识别项目中的隐秘 AI 使用。
人们可能会就其 AI 使用情况对我们撒谎或误导我们,但我们想向他们发出信号,如果这种行为被发现,他们将失去善意假设,其账户将被暂停。因此,将此类软件构建平台投资在 SourceHut 上并非明智选择,我们希望理性的用户会据此做出选择。
SourceHut 上现有使用 AI 辅助进行工作的项目,只要其未来的开发采纳与我们的服务条款一致的政策,便可以继续留在 SourceHut 上。如果您之前在软件中使用过 AI 工具,并希望留在 SourceHut,我们不会进行追溯性执法,并且我们将对那些因他人过去使用 AI 而羞辱或骚扰他们的用户采取行动。尽管如此,我们仍邀请您在考虑迁移之前,审视此处提出的论点,并在未来调整您的工作方式。
## 如果您的项目受到影响
在政策变更生效后仍利用并打算继续利用 AI 辅助的项目,将与大多数服务条款违规情况一样处理:保持耐心和理解。如果您或您的项目受到这些变更的影响,并希望继续使用生成式 AI 工具,您需要尽早迁离 SourceHut。没有硬性截止日期,但您应尽快制定可行的迁移计划。
SourceHut 是自由开源软件。欢迎您按照安装说明(https://man.sr.ht/installation.md)自行托管,或寻找运行自有实例并欢迎您的社区。我们也可以推荐 Forgejo(https://forgejo.org/)作为更易于部署的代码托管平台,可能适合您的需求,并且公共实例列表(https://codeberg.org/forgejo-contrib/delightful-forgejo#user-content-public-instances)可供参考。如果您希望保留...
相似文章
NLNet Labs LLM 政策
NLNet Labs 宣布了一项限制在代码和文档贡献中使用 LLM 的政策,要求披露 LLM 的使用情况,并禁止 AI 生成的代码。
一般决议:Debian中的LLM使用
Debian正在举行一项一般决议,以决定是否禁止使用LLM或生成式AI做出的贡献,理由是版权和质量问题。
Codeberg:服务条款扩展以禁止LLM数据提取
Codeberg正在更新其服务条款,明确禁止为训练大型语言模型而提取数据(LLM-extrusions),旨在保护平台上的存储库免受未经授权的使用。
如果没有开源大语言模型,美国AI公司本可以垄断这项技术
一篇评论文章认为,开源大语言模型(尤其是来自中国的大语言模型)阻止了美国AI公司垄断这项技术,并倡导将开源视为一项道德责任。
当他们停止补贴LLM订阅时会发生什么?
关于LLM订阅不可持续补贴的评论,预测随着风投资金收紧,价格将上涨,生态系统发生变化,并对开源模型的可用性和硬件成本表示担忧。