Codeberg: 服务条款更新,禁止LLM滥用

开源代码托管平台 Codeberg 更新了服务条款,明确禁止使用其服务来训练大规模语言模型(LLM)或进行其他形式的AI滥用。这一举措引发了关于AI训练数据来源、代码社区与AI公司之间矛盾的广泛讨论。

Codeberg: 服务条款更新,禁止LLM滥用

一句话看懂:开源代码托管平台 Codeberg 更新了服务条款,明确禁止使用其服务来训练大规模语言模型(LLM)或进行其他形式的AI滥用。这一举措引发了关于AI训练数据来源、代码社区与AI公司之间矛盾的广泛讨论。

事件核心:发生了什么

根据 Codeberg 发布的最新服务条款,用户不得利用该平台托管的内容来训练、微调或构建大规模语言模型及其他基于AI的系统。这一更新明确将LLM的训练行为列为服务禁止项。Codeberg 是一个面向自由和开源软件(FLOSS)项目的非营利性代码托管平台,基于 Forgejo 分支运行(Forgejo 是从 Gitea 硬分叉而来的GPLv3许可项目)。事实上,该平台长期禁止私有仓库作为个人云存储使用,强调其定位是服务开源社区,而非商业闭源项目的代码仓库。此次更新进一步收紧了AI相关的使用边界。

为什么重要

在AI训练数据来源日益敏感的背景下,Codeberg 的行动标志着代码社区对无限制抓取代码进行LLM训练的明确反击。与GitHub等大型平台通过API限制、许可证合规等方式间接约束AI用户不同,Codeberg直接通过服务条款来切断AI公司对其用户代码的批量获取。这一做法可能引发更多代码托管平台效仿,形成对于AI训练数据合法性的多层级壁垒。考虑到现在及未来,AI生成的代码质量可能会逐步提升甚至超过人类,这种禁止策略是否会长期有效、是否能覆盖所有类型的模型训练,仍然存在争议。

对用户/开发者/创作者的影响

对于发布纯人类代码的开发者而言,条款变化影响不大,但只要违反条款,平台将有权删除账户和作品。值得注意,Codeberg 表示目前采用人工且非自动化的方式来执行条款,不会在缺乏通知的前提下随意删除内容。不过,对于使用 LLM辅助写作或编写代码的创作者,若平台认定其内容来源涉及LLM训练,可能面临数据被清除的风险。对于希望在代码社区内建立高标准“人类专属”环境的用户,这一政策强化了 Codeberg 作为避风港的价值。而将Codeberg作为唯一存储仓库且没有备份的用户,则应留意合规和数据安全的双重要求。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

首先,禁止LLM训练能否在被AI代码充斥的未来环境中得到有效执行,未来可能需要更具体的“AI生成内容”检测标准。其次,GitHub或GitLab等大型平台是否会根据监管压力或社区情绪更新自身条款,值得观察。第三,更多小型代码托管平台、论坛可能效仿Codeberg,催生出一批“仅限人类”的开发社区,从而改变开源生态中代码流动和共享的方式。

来源:hackernews

celebrityanime
celebrityanime
文章: 14694

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注