Professional Knowledge
AI训练数据用别人的内容算侵权吗?生成式AI有哪些版权风险?
2026-07-09版权
一句话答案
这是当前版权领域较前沿也最争议的问题,法律还在快速演进中。
详细解释
- 训练阶段对作品的「转换性使用」,类似人类学习过程
- 美国:部分法院认为训练使用属于合理使用(但OpenAI等公司仍面临多起诉讼)
- 日本:明确允许为AI训练使用版权内容(全球最宽松)
- 欧盟:要求AI公司必须公开训练数据中使用了哪些版权内容
- 中国:2024年《生成式AI服务管理暂行办法》要求训练数据来源合法
- 多个创作者集体诉讼:指控AI公司「大规模版权侵权」
✅ 使用已明确可商用的数据(公共领域/CC协议/已购授权) ✅ 建立训练数据来源台账,能说清楚数据从哪里来 ✅ 对用户生成内容做版权风险提示 ✅ 关注国内司法动态,及时调整策略
- 直接爬取付费内容(小说/图片/视频)用于训练
- 用版权内容训练后,生成的同类内容与原作高度相似
- 声称AI生成内容「完全不侵权」
- 2023年深圳南山法院:AI生成内容可以构成作品,权利归使用者
- 2024年业界共识:AI辅助创作的内容,人类有实质性贡献的,可受版权保护
风险提醒
⚠️ 各国对AI训练数据的法律态度差异极大,出海AI产品尤其要注意;中国对生成式AI的监管趋严,训练数据来源合规是必查项;AI生成内容如与现有作品高度相似,仍可能构成侵权。
免责声明
本站公开知识内容仅供信息参考,不构成正式法律意见,也不代表对商标注册、专利授权、项目申报或争议处理结果的承诺。