保护我们的自由及开源软件(FLOSS)公共资源免受大型语言模型(LLMs)的侵害

开源代码托管平台 Codeberg e. V. 的成员投票通过了两项与 AI 相关的动议:一是承诺不会将用户数据用于训练 LLM,二是修改服务条款以禁止“氛围编码”(vibe-coded)项目。此举反映了 LLM 技术正对开源基础设施和社区生态造成实质性压力。

保护我们的自由及开源软件(FLOSS)公共资源免受大型语言模型(LLMs)的侵害

一句话看懂:开源代码托管平台 Codeberg e. V. 的成员投票通过了两项与 AI 相关的动议:一是承诺不会将用户数据用于训练 LLM,二是修改服务条款以禁止“氛围编码”(vibe-coded)项目。此举反映了 LLM 技术正对开源基础设施和社区生态造成实质性压力。

事件核心:发生了什么

Codeberg e. V. 的年会投票在 2026 年 7 月结束,14 天投票期内产生了两项通过决议。第一项是针对数据使用的声明:Codeberg 承诺不会利用其托管的代码和用户数据去训练或运行任何“生成式 AI”工具(包括 LLM),认为这些技术与负责任地维护自由开源软件的精神相悖。第二项更具争议性,以 358 票同意对 144 票反对(14 票弃权)通过,投票率接近 50%。该决议要求修改使用条款,明确禁止“氛围编码”项目。Codeberg 将其定义为:由单个开发者使用 LLM 大量生成、缺乏真实社区支持、但消耗大量 CI/CD 和存储资源的“幽灵项目”。运营方观察到,这些项目在资源消耗上甚至超过了平台上一些最大的社区项目,这被视作对有限捐赠资金的不合理占用。

为什么重要

这一事件揭示了 LLM 对开源生态的两层威胁。第一层是基础设施成本外溢:LLM 训练和推理推动了硬件(特别是 SSD 和内存)价格暴涨。Codeberg 指出,其采购的用于代码托管的硬盘价格从几年前约 700 欧元涨至现在约 3700 欧元且经常缺货。同时,LLM 公司的爬虫对平台产生的“无意义索引”流量导致服务负担加重,管理员不得不花精力构建防御机制,甚至限制了正常用户。第二层是社区价值侵蚀:“氛围编码”带来的高资源消耗、低社区互动的项目模式,已开始扭曲开源项目投入资源与产出真实价值之间的平衡。

对用户/开发者/创作者的影响

对于普通开源贡献者,这意味着 Codeberg 上的环境正在因为 LLM 相关流量和资源滥用而变差,平台被迫施加访问限制。对于“氛围编码”的开发者,Codeberg 的新服务条款将可能直接封禁你的项目,如果你被判定为没有真实用户和社区、但利用大模型大量提交代码并消耗 CI/CD 资源的项目。对于其他 FLOSS 平台(如 GitHub、GitLab),Codeberg 的立场也给出了信号:平台开始认真衡量 LLM 对有限公共计算资源的侵蚀效应,未来可能有更多平台出台类似限制。从事 AI 基础设施采购(如服务器、存储)的用户,需注意 LLM 导致的硬件成本大幅上涨已经在可预见的未来持续影响开源托管成本。

值得关注的后续

第一,Codeberg 是否会公布更具体的“氛围编码”项目判定标准,以及执行后封禁案例的数据统计。第二,其他大型代码托管平台(如 GitHub Copilot 背后的微软、GitLab 与 Google Cloud 的合作)是否会在用户协议中对 AI 训练和资源消耗做出类似限制。第三,LLM 公司是否会调整爬虫策略、减小对开源平台的非必要请求,或通过合法许可/补偿方式接入代码数据,以平息此类社区抗议。

来源:blog.codeberg.org

celebrityanime
celebrityanime
文章: 14905

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注