海盗湾 vs Anthropic:为什么盗版违法,AI训练却合法?
版权法有一个很荒诞的断层:把一段受版权保护的视频原封不动传到海盗湾是重罪,但把几千万人的作品抓下来训练一个收费AI模型,目前却能游走在灰色地带。
Anthropic 最近被一群作者告上法庭,起因就是 Claude 的训练语料里包含了海量的书和文章。原告律师说这是"工业规模的侵权",Anthropic 那边则拿「合理使用」当盾牌。两边都能讲出一套道理,但我在这个问题上站作者多一点。
区别在哪儿?海盗湾的行为是复制完整作品+无限分发,直接抢了原作的市场;而AI训练是做统计学习,产出的是全新的文本,理论上不构成替代。听起来很合理对吧?可现实是,提示词够长的时候,模型可以近乎逐字复现某本书的段落。那"训练"和"复制"之间的边界就变得很模糊了。
再说权利不对等。我写一篇长文发在网上,任何爬虫都能把它吞进数据集,我连个拒绝的入口都没有。即便我写清楚了"禁止用于AI训练",现在主流抓取工具一样当没看见。这不叫合理使用,这叫单方面的拿走。
有意思的是,技术宅们当年捍卫海盗湾的逻辑,和现在AI公司辩护的逻辑惊人地像:都是说"信息应当自由"。可海盗湾免费分享,Anthropic按订阅收费。一边是白嫖到底,一边是先用后卖,哪个更像商业剥削?
所以别信"AI是合理使用"这种话术,它只是还没被法院盖棺定论。等几个案子判完,版权法要么被钻出一个大洞,要么被补上一个补丁。到时候不管胜负,数据抓取这件事肯定要被重新定义。
事件追踪 · 相关报道
安thropic的CEO Amodei最近放话
5小时前
**当AI真的闯祸,法律该找谁算账?
5小时前
Claude/Codex API 打到一折?
18小时前
PISIGuard:把你的个人信息挡在AI聊天窗口之外
20小时前
Claude发布恶意代码攻击3家真实公司:到底怎么回事
1天前
CostPerPrompt:用真实工作负载算AI API账单
2天前
更系统的工具评测汇总在AI工具实测笔记,有不少直接可参考的案例。