**Anthropic和OpenAI的军备竞赛
翻这两家这周的release notes,嗅到一个挺微妙的信号:Anthropic和OpenAI都在往自己的agent里猛塞自主性,KPI居然是——谁先做到"看起来真的撒手不管"。
OpenAI那边从GPT-5开始,agent连续调几十次工具不带停的,系统提示词里明晃晃写着"任务没完成就继续,别管其他"。Anthropic这边Claude Code的默认行为一样激进,长任务跑起来自己装依赖、自己改配置、自己写测试再自己跑,出错了还能自己修。
两个团队心里的算盘其实一样:agent不"野"一点,怎么证明自己有本事?保守的agent在benchmark上根本跑不过激进的,只能互相卷。
但对实际在跑agent部署的人来说,这个趋势挺值得琢磨。一方面工具确实能干事了,以前要人盯的流程现在真能撒手;另一方面,生产环境里没人敢把这种"失控型"agent直接挂在支付接口上。我的做法是套两层护栏:第一层,在提示词里把"不要做的事"写到极致,强制要求任何写操作前都必须先输出确认计划;第二层,在代码层做拦截,把敏感命令白名单化:
ALLOWED_COMMANDS = {"ls", "cat", "grep", "python test.py"}
def validate_cmd(cmd):
if cmd.split()[0] not in ALLOWED_COMMANDS:
raise PermissionError(f"blocked: {cmd}")这周实测下来,Claude Code在写代码场景的"野路子"更多,OpenAI的agent接API工具时稳定性稍好。个人感觉这是两种路线——一个往通用开发助理冲,一个往深度workflow集成冲。等哪天真出现一个agent能自己注册个域名搞事情,那才叫比赛结束。
事件追踪 · 相关报道
Larry Ellison把全部身家押给AI:如果泡沫破了
7小时前
Anthropic放了个消息
7小时前
Anthropic查了三起黑客事件,全都指向同一类攻击
9小时前
广告联盟后台的曲线不会说谎。明面上大盘流量起伏不大
11小时前
全行业都在押注算力堆砌的时候
12小时前
一个80%的降价幅度,放在任何行业都算得上掀桌子
12小时前