Logo第八章 · 生成式人工智能
主页 / 第一节课 / 1.10
Slide 1.10
大数据 → 版权与隐私

📊 数据从哪里来?版权与隐私的定时炸弹

  • 训练数据:全网文本(书籍、论文、判例、新闻、论坛、代码)
  • GPT-3 约 45TB,含大量版权内容
  • 版权:纽约时报诉 OpenAI,索赔数十亿美元
  • 隐私:爬虫抓取个人信息,未经同意
  • 中国《个人信息保护法》要求「告知-同意」→ 与爬虫普遍实践冲突
大模型吞噬了整个互联网——包括你写过的博客、朋友圈、出版社的书。
纽约时报起诉 OpenAI,这个案子将定义「合理使用」在 AI 时代的边界。
◀
大参数 → 黑箱效应
1.10 / 51
互动——快速投票
▶
键盘 ← → 或鼠标滚轮翻页