LLM 生成代码能否纳入自由软件?多地法律立场解读
分析美国、欧盟等司法辖区的版权原则,探讨 LLM 生成代码的版权归属及其纳入自由软件许可的可行性。
随着大语言模型(LLM)在代码生成场景中被广泛使用,一个绕不开的法律问题随之浮出水面:由 LLM 直接产出的代码,是否享有版权?如果享有,权利归属于谁?这一问题之所以关键,是因为版权是自由软件(Free Software)法律体系的基石——一旦无法厘清权属,基于「四项基本自由」的许可框架便难以正常运行。
版权归属的基本原则:作者须为自然人
传统版权法长期默认作品作者为「自然人」。美国版权办公室早在 1965 年就明确表态:判断一部作品能否受版权保护,关键在于其本质上是否属于人类创作,机器只是辅助工具;若作品中的文学、艺术或音乐表达并非由人构思并执行,而是由机器产出,则不受版权保护。这一立场在 2025 年 1 月发布的最新报告中被再次重申,并未因 AI 技术的兴起而松动。
欧盟的判断方向基本一致。虽然目前尚未出台专门针对 LLM 生成作品的统一立法,但 2024 年欧盟理事会就 AI 与版权关系开展的成员国政策问卷显示,多数成员国认同:纯由 LLM 产出的作品不构成版权法意义上的作品,只有自然人方可成为作者。
思想—表达二分法与机器生成内容
版权法的核心假设是:将创意构想「实现」为作品的过程最为困难,因而值得保护。换言之,「狮子出演《哈姆雷特》」是一个构想,不受版权保护;而把这一构想拍成电影《狮子王》,才是受保护的表达。这种区分在法学上被称为「思想—表达二分法」。
LLM 的出现打破了「构想—实现」均由人类完成这一传统链条:人类可能只提供一句提示(prompt),而由模型完成后续全部实现与表达。由此带来的直接后果是,纯由 LLM 生成的内容在多数司法辖区难以获得版权保护。
英国的例外与自由软件语境
并非所有司法辖区立场一致。英国与爱尔兰此前曾对「计算机生成作品」设立过专门制度,将作品归于「作出必要安排的人」。但这类规定的适用范围与 AI 时代的契合度,仍存在较大争议。
在自由软件语境下,这一问题尤为关键:不受版权保护的作品自动进入公共领域,任何人都不能对其附加许可条款,包括要求下游衍生作品继续开放的规定。这意味着一段纯 LLM 生成、缺乏人类实质性贡献的代码,即便开发者希望以 GPL 等自由软件许可证发布,也无法在法律上获得「版权许可」的地位——因为本就没有版权可许可。
对开发者的启示
从美国版权办公室 2025 年的报告与欧盟 2024 年的政策问卷来看,主流司法辖区的立场高度趋同:人机协作中,只有具备人类实质性创作贡献的部分才可能获得版权保护;纯由 LLM 输出的内容,则难以落入版权保护范围。对于希望为自由软件项目贡献代码的开发者而言,意味着仅凭一句提示词生成的代码,在法律上不能简单以自由软件许可证的形式「授权」给他人使用。
要在自由软件项目中合规地使用 AI 工具,开发者需要关注自身的提示与编辑是否构成「人类作者身份」意义上的实质性贡献;同时,社区与许可证方也在逐步探索如何在尊重版权基本原则的前提下,为 AI 辅助开发建立更清晰的规则框架。
