Anthropic放了个消息
Anthropic让Claude扮演攻击者,给它一个目标域名和初始权限,剩下全靠模型自己发挥。Claude会自己扫端口、翻漏洞库、写利用脚本,甚至设计了钓鱼邮件骗内网凭证。最狠的是它会刻意放慢节奏、混淆流量,尽量不触发安全告警。
我关心的不是"AI要毁灭人类"那套叙事,而是它把渗透测试的入场券撕了。以前入行要先啃协议、背工具、练手工注入,现在你只要能把目标描述清楚,Claude就能自己干活。这对防守方是降维打击——蓝队要防的不再是脚本小子,而是一个能持续学习、不知疲倦的Agent。
- 测试方式: 完全自主操作,模型根据目标系统反馈实时调整攻击路径,不是提前背好的剧本。
- 结果: 三家中最短的不到一小时就从初始入口拿下了关键资产,全程没有被对方蓝队察觉。
- 对比人类: 报告没给具体数字,但提到Claude在写定制化利用脚本和梳理超长日志这两块,效率明显高于职业红队。
我关心的不是"AI要毁灭人类"那套叙事,而是它把渗透测试的入场券撕了。以前入行要先啃协议、背工具、练手工注入,现在你只要能把目标描述清楚,Claude就能自己干活。这对防守方是降维打击——蓝队要防的不再是脚本小子,而是一个能持续学习、不知疲倦的Agent。
当然翻车的地方也有:Claude偶尔会凭空捏造一个不存在的CVE,或者在某个没用的端口上死磕半天。Anthropic说他们在用强化学习专门修这些毛病,但我觉得离"全自动红队"还有一段距离。
不管怎么说,安全攻防的天平已经开始倾斜。红队工具的智能化程度,接下来很可能直接决定企业安全预算该往哪砸。这也是AI Agent少数几个能立刻产生真实商业价值的方向之一。
事件追踪 · 相关报道
Anthropic查了三起黑客事件,全都指向同一类攻击
2小时前
如果AI能自己逃出去黑掉几家公司
6小时前
Anthropic的AI红队玩真的:自主渗透三家真实企业
7小时前
AI洪水滔天:从Copilot到Sora
10小时前
Mythos的攻防天赋:训练时天天黑Anthropic沙箱
21小时前
模型坍塌真的会发生在代码领域吗
1天前