大型语言模型训练使用受版权保护内容的合法性仍存争议 美国政府公开支持OpenAI

摘要:

特朗普政府近日向纽约时报起诉OpenAI一案提交了一份20页法律意见书,支持OpenAI未经授权使用受版权保护材料训练大型语言模型的做法。政府在文件中表示,美国在人工智能领域保持全球竞争力和领导地位符合国家利益,不应因对合理使用原则的误解而限制人工智能的发展,否则可能阻碍创新、科学进步以及美国经济增长和社会流动。

ChatGPT、Claude和Gemini等聊天机器人背后的大型语言模型,通常依靠规模庞大的数据集进行训练,其中包括受版权保护的书籍、新闻报道及其他媒体内容。许多出版机构认为,人工智能公司未经许可使用这些材料训练模型涉嫌违法。争议的核心在于,这种使用是否属于美国版权法中的“合理使用”,以及模型训练是否足够具有“转换性”,从而能够被认定为合法。

目前,美国有关人工智能训练与版权侵权的案件总体上对人工智能公司较为有利。此前,法官威廉·奥尔萨普曾要求Anthropic向一批作家支付15亿美元版权和解金,但处罚重点并非模型训练本身,而是该公司通过非法影子图书馆盗取用于训练的书籍。奥尔萨普当时认为,人工智能模型学习作品的过程,更接近人类读者阅读书籍后创作不同作品,而不是直接复制或取代原作。

不过,特朗普政府此次提交的文件并不是法院裁决。案件目前仍由纽约南区联邦地区法院审理,政府并不拥有裁决该案的司法管辖权。但由于联邦政府直接介入,相关立场仍可能对案件审理及更广泛的人工智能版权政策讨论产生影响。

查看评论
created by ceallan