AI训练数据版权问题可能是21世纪最重要的知识产权案件。围绕"AI公司是否可以在未获授权的情况下使用公开网络内容训练模型"这一核心问题,全球司法体系正在进行激烈的博弈。
里程碑判决
纽约时报诉OpenAI和微软案在美国最高法院达成具有里程碑意义的判决:AI公司使用公开网络内容进行模型训练属于"转换性使用",原则上不构成侵权。但判决同时要求AI公司必须提供"选择退出"机制,允许内容创作者禁止其作品被用于训练,并建立内容创作者的补偿基金。
行业影响
这一判决为AI行业提供了法律确定性。训AI公司将需要投资建立强大的"选择退出"合规系统。内容产业正在分化——大型新闻集团选择与AI公司达成授权协议(年授权费从数百万到数千万美元不等),而小型创作者则通过平台级的集体谈判机制获得补偿。
AI行业和内容产业不是零和博弈。好的法律框架应该让AI的创新动力和创作者的权利保护并行不悖。
全球响应
欧盟和日本采取了不同的路线。欧盟在AI法案中要求所有通用AI模型的提供者公开其训练数据的详细摘要。日本则采取了最宽松的立场——明确允许AI公司使用任何合法获取的数据进行训练。全球AI版权治理仍处于碎片化状态,但方向正在逐渐明朗。