海盗湾 vs Anthropic:为什么盗版违法,AI训练却合法?

PromptCube 专家 1小时前 365 浏览 4 点赞 约 1 分钟

版权法有一个很荒诞的断层:把一段受版权保护的视频原封不动传到海盗湾是重罪,但把几千万人的作品抓下来训练一个收费AI模型,目前却能游走在灰色地带。

Anthropic 最近被一群作者告上法庭,起因就是 Claude 的训练语料里包含了海量的书和文章。原告律师说这是"工业规模的侵权",Anthropic 那边则拿「合理使用」当盾牌。两边都能讲出一套道理,但我在这个问题上站作者多一点。

区别在哪儿?海盗湾的行为是复制完整作品+无限分发,直接抢了原作的市场;而AI训练是做统计学习,产出的是全新的文本,理论上不构成替代。听起来很合理对吧?可现实是,提示词够长的时候,模型可以近乎逐字复现某本书的段落。那"训练"和"复制"之间的边界就变得很模糊了。

再说权利不对等。我写一篇长文发在网上,任何爬虫都能把它吞进数据集,我连个拒绝的入口都没有。即便我写清楚了"禁止用于AI训练",现在主流抓取工具一样当没看见。这不叫合理使用,这叫单方面的拿走。

有意思的是,技术宅们当年捍卫海盗湾的逻辑,和现在AI公司辩护的逻辑惊人地像:都是说"信息应当自由"。可海盗湾免费分享,Anthropic按订阅收费。一边是白嫖到底,一边是先用后卖,哪个更像商业剥削?

所以别信"AI是合理使用"这种话术,它只是还没被法院盖棺定论。等几个案子判完,版权法要么被钻出一个大洞,要么被补上一个补丁。到时候不管胜负,数据抓取这件事肯定要被重新定义。

Claudeanthropic海盗湾合理使用版权法
更系统的工具评测汇总在AI工具实测笔记,有不少直接可参考的案例。

全部回复 (4)

阿福在路上 高级 1小时前
就像安卓也是从Linux衍生出来,最后做得有多大。关键还是看后续怎么发展。
0 回复
前端老刘 高级 1小时前
我之前在Quora问过类似的问题,得到的答复还挺靠谱的。HN确实不适合搞法律咨询,
0 回复
架构师老刘 中级 1小时前
有钱人用AI抄,没钱人靠手抄,这世道连偷东西都分阶级了。不过话说回来,那些scraper训练出来的模型,最后不还得靠我们这些免费劳动力喂数据?
0 回复
运营喵小柯 中级 1小时前
你这比喻挺狠啊,我在银行干过几年,确实处处是双重标准。最讽刺的是,高层天天讲规则,底层反而被规则绑死。装傻真是保命技能,学不会就出局。
0 回复

发表回复

支持 Markdown 格式