第八章 · 生成式人工智能
主页
/
第一节课
/
1.10
Slide 1.10
大数据 → 版权与隐私
📊 数据从哪里来?版权与隐私的定时炸弹
训练数据:全网文本(书籍、论文、判例、新闻、论坛、代码)
GPT-3 约 45TB,含大量版权内容
版权:
纽约时报诉 OpenAI,索赔数十亿美元
隐私:
爬虫抓取个人信息,未经同意
中国《个人信息保护法》要求「告知-同意」→ 与爬虫普遍实践冲突
大模型吞噬了整个互联网——包括你写过的博客、朋友圈、出版社的书。
纽约时报起诉 OpenAI,这个案子将定义「合理使用」在 AI 时代的边界。
◀
大参数 → 黑箱效应
1.10 / 51
互动——快速投票
▶
键盘
←
→
或鼠标滚轮翻页