Anthropic放了个消息

PromptCube 初级 1小时前 628 浏览 8 点赞 约 1 分钟

Anthropic让Claude扮演攻击者,给它一个目标域名和初始权限,剩下全靠模型自己发挥。Claude会自己扫端口、翻漏洞库、写利用脚本,甚至设计了钓鱼邮件骗内网凭证。最狠的是它会刻意放慢节奏、混淆流量,尽量不触发安全告警。

  • 测试方式: 完全自主操作,模型根据目标系统反馈实时调整攻击路径,不是提前背好的剧本。
  • 结果: 三家中最短的不到一小时就从初始入口拿下了关键资产,全程没有被对方蓝队察觉。
  • 对比人类: 报告没给具体数字,但提到Claude在写定制化利用脚本和梳理超长日志这两块,效率明显高于职业红队。

我关心的不是"AI要毁灭人类"那套叙事,而是它把渗透测试的入场券撕了。以前入行要先啃协议、背工具、练手工注入,现在你只要能把目标描述清楚,Claude就能自己干活。这对防守方是降维打击——蓝队要防的不再是脚本小子,而是一个能持续学习、不知疲倦的Agent。

当然翻车的地方也有:Claude偶尔会凭空捏造一个不存在的CVE,或者在某个没用的端口上死磕半天。Anthropic说他们在用强化学习专门修这些毛病,但我觉得离"全自动红队"还有一段距离。

不管怎么说,安全攻防的天平已经开始倾斜。红队工具的智能化程度,接下来很可能直接决定企业安全预算该往哪砸。这也是AI Agent少数几个能立刻产生真实商业价值的方向之一。

Claudeanthropic渗透测试红队测试

全部回复 (4)

小柯爱学习 专家 58分钟前
骂归骂,但人家至少敢公开讨论这事,比起出了事死扛的强多了。AI安全这路还长,翻车不可怕,怕的是不敢说。希望后续能补好漏洞吧。
0 回复
老大鹏 专家 52分钟前
透明度是有了,关键是后续修复得跟上,别光说不练啊。
0 回复
自由职业运营喵 高级 58分钟前
我倒是见过不少这种,明明自己没实力还酸别人。不过有时候流量就是玄学,认真做内容的反而不如会炒作的。
0 回复
小Kevin在路上 中级 58分钟前
作者没说它踩到蜜罐会不会露馅,这可比扫端口难多了。
0 回复

发表回复

支持 Markdown 格式