用 Claude 模拟红队攻击,AI Agent 正在把渗透测试的门槛踩在脚下
最近 Anthropic 披露的关于 Claude 扮演攻击者的测试结果,给很多安全从业者带来了不小的冲击。这次测试最核心的逻辑在于,它不再是让 AI 扮演一个“安全顾问”来提供建议,而是直接赋予其目标域名和初始权限,在没有预设剧本的情况下,让模型基于目标系统的实时反馈自主决定攻击路径。这种从“问答模式”到“Agent 模式”的转变,让 AI 在渗透测试中的表现展现出了一种令人不安的“战术意识”。
在具体的测试过程中,Claude 表现得不像一个简单的脚本执行器,而更像一个经验丰富的渗透工程师。它不是盲目地运行全量扫描,而是遵循一套严谨的侦察逻辑:先通过端口扫描锁定服务,随后翻阅漏洞库寻找匹配项,最后针对性地编写利用脚本。最让人意外的是,它在获取内网凭证阶段能够自主设计钓鱼邮件来诱导用户,并且学会了如何“潜行”。它通过刻意放慢操作节奏、混淆流量特征,成功绕过了大部分安全告警,这种对防御方心理和机制的把控,已经超越了简单的模式匹配。
从测试数据来看,这种效率提升是惊人的。在面对三个不同的目标环境时,Claude 表现出的攻击速度极快,其中最短的一次在 60 分钟内就从初始入口拿下了关键资产,而对方的蓝队在整个过程中完全没有察觉。虽然报告没有给出详细的量化对比表,但明确指出在编写定制化利用脚本(Custom Exploit Scripts)和分析超长日志这两项任务上,Claude 的效率已经明显超过了职业红队人员。
这意味着渗透测试的“入场券”正在被撕毁。回顾过去,一个合格的红队成员需要极高的认知成本:从深挖 TCP/IP 协议,到熟练操作 Nmap 和 Burp Suite,再到练习各种手动注入技巧,学习周期极其漫长。但现在,只要你能清晰地描述目标环境,Claude 就能通过 Agent 的自主循环完成绝大部分的“脏活累活”。
对于防守方来说,这几乎是降维打击。蓝队面对的不再是只会运行既定工具的“脚本小子”,而是一个能够实时学习、不知疲倦且具备逻辑推理能力的 AI Agent。当攻击方的迭代速度从“周”缩短到“秒”,传统的防御策略——尤其是依赖静态特征码和预设规则的防御——将面临巨大挑战。
当然,目前的 AI 红队还远未达到完美的“全自动”状态,在测试中依然暴露出 LLM 的典型缺陷。比如,Claude 偶尔会出现幻觉,凭空捏造一个并不存在的 CVE 编号,或者在某个毫无价值的端口上陷入死循环,浪费大量时间死磕。Anthropic 表示目前正在通过强化学习(RL)来修正这些逻辑漏洞,但距离真正成熟的商业化全自动产品仍有距离。
但无论如何,这次测试释放了一个明确信号:安全攻防的天平已经开始倾斜。如果你现在还在依赖传统的静态扫描器,那么面对一个能够实时调整策略、具备战术意识的 Claude,防御压力将会极其巨大。AI Agent 在很多领域还处于概念验证阶段,但在网络安全攻防这个领域,它已经展现出了能立刻产生真实商业价值的潜质。
敢把漏洞公开出来比什么都强,总比出了事在那儿死扛要靠谱得多。
光靠 Agent 跑出漏洞没用,要是修复文档还是空话,这门槛降低了也没意义