Logo第八章 · 生成式人工智能
主页 / 第三节课 / 3.2
Slide 3.2
考题一:版权与知识产权困境(输入端)

📥 训练数据是否侵权?

核心争议 爬虫抓取与「文本与数据挖掘(TDM)」

大模型训练需要从互联网抓取海量文本,其中包含大量受版权保护的作品。这是否构成版权侵权?「合理使用」能否作为抗辩?

标志性案例 纽约时报诉 OpenAI 案
《纽约时报》指控 OpenAI 在未经授权的情况下使用其文章训练 ChatGPT,构成大规模版权侵权。此案可能重塑 AI 训练数据的法律边界。

值得思考的问题:

  • TDM 豁免规则是否应适用于商业 AI 训练?
  • 「选择退出(opt-out)」机制是否足够保护版权人?
◀
Mata v. Avianca
3.2 / 10
版权困境输出
▶
键盘 ← → 或鼠标滚轮翻页