重点议题 · 01
训练数据与生成内容知识产权
核验训练、微调与检索增强(RAG)素材合法来源,完善人类独创性智力投入存证,规范生成成果商用确权、授权许可及侵权争议化解。
大模型训练数据合法性如何论证?AI生成内容能否直接商业化利用?
适用情形
- 采购、清洗或使用第三方数据集开展模型预训练与微调
- 使用企业内部资料、客户资料或网络公开数据构建 RAG 知识库
- 将 AI 生成的文本、图像、音视频或代码资产投入商业使用
- 面临第三方侵权指控,或发现生成物存在实质性相似侵权隐患
审查重点与准备材料
- 01梳理数据资产来源、授权协议及适用的法定使用条件
- 02保存提示词、系统指令、模型参数及人工修改调试过程留痕
- 03核验基础模型商业开源协议、附加限制条款及数据回传政策
- 04构建侵权通知、下架响应、异议申诉与证据保存流程
相关案例
案例分析
以下案例涉及不同技术和程序阶段。可结合各案事实比较责任认定与处理结果,并留意其适用范围。
北京人工智能文生图案
法院结合提示词、参数调整和生成过程,认定涉案图片体现了使用者的智力投入和个性化表达,并据此判断作品属性与权利归属。
一审判决
- 法院认定涉案图片符合独创性要求。
- 人工智能模型不具有法律主体资格,具体生成过程中的人类投入成为作者认定的重要依据。
广州奥特曼生成图片案
被告通过接口接入第三方人工智能绘画服务,用户输入奥特曼相关提示词后可以生成与权利作品实质性相似的图片。法院认定被告属于生成式人工智能服务提供者,相关生成行为侵害复制权和改编权。
一审判决
- 法院认定部分生成图片复制了奥特曼形象的独创性表达,另有部分图片在保留相关表达的基础上形成新特征,分别侵害复制权和改编权;对信息网络传播权不再重复评价。
- 被告经由接口向用户提供人工智能绘画服务,仍属于生成式人工智能服务提供者。法院要求其采取技术措施,防止用户正常输入奥特曼相关提示词时继续生成实质性相似图片。
英国 Getty Images 案
Getty Images 起诉 Stability AI,主张 Stable Diffusion 的训练、模型传播和带有 Getty Images 或 iStock 水印的输出侵害知识产权。庭审结束前,Getty Images 撤回训练、输出版权和数据库权主张;法院驳回模型次级版权侵权主张,仅在少量历史生成水印样本上认定商标侵权。
一审判决,部分事项上诉中
- 法院认定无形模型可以属于英国版权法所称“物品”,但 Stable Diffusion 模型权重从未存储或复制涉案作品,因此不属于“侵权复制件”,次级版权侵权请求被驳回。
- Getty Images 在特定旧版本生成的少量 iStock 和 Getty Images 水印样本上部分胜诉,法院强调结论范围有限,无法据此推定所有水印输出均侵权。
美国 ROSS 训练数据案
ROSS 为开发法律检索工具使用由 Westlaw 判例要旨改写而来的训练材料。地区法院认定其中大量要旨受保护并否定合理使用抗辩,第三巡回上诉法院已受理中间上诉。
部分简易判决,上诉待决
- 地区法院就 2243 条判例要旨作出有利于 Thomson Reuters 的部分简易判决。
- 地区法院认为该训练用途具有竞争性,并据此否定合理使用抗辩。
美国 Anthropic 图书训练案
法院先后区分模型训练、纸质书数字化和从盗版资料库下载图书,随后批准 15 亿美元集体诉讼和解。该案把训练行为与训练资料的取得方式分别处理。
集体诉讼和解获最终批准
- 法院认为本案记录下的模型训练用途和已购纸质书数字化属于合理使用。
- 法院认为从盗版资料库取得并保存图书的行为需要独立审查,不能由后续训练用途当然覆盖。
美国 Meta 图书训练案
作者主张 Meta 未经许可使用图书训练 Llama。法院根据当时的举证记录就部分原告作出有利于 Meta 的简易判决,同时强调市场损害证据会影响其他案件的结论。
部分简易判决,案件仍在审理
- 法院认定 Meta 的训练用途具有转换性。
- 本案原告没有提交足以证明相关市场损害的证据,Meta 就该批原告的著作权请求获得简易判决。
配套专项服务
相关专项服务
适用法规与治理指引
相关法规与治理文件
研究团队