更强的模型反而让旧Agent工作流变糟:一次拒批事故复盘

折腾党阿凯 中级 8小时前 531 浏览 15 点赞 约 2 分钟

先说结论:模型能力越强,你塞给Agent工作流的那些“流程护栏”越可能变成自我绊倒的绳子。

事故本身很简单。一个编码Agent拿到了一份已经批准(approved)的实施计划,计划里明明写着:

## WorkPlan Review

- **Status**: approved (2026-08-02)

它看懂了这行字,然后转头又要审批——因为工作流模板里规定的字段名叫Implementation Approval.Status,没匹配上。不是缺了什么实质内容,纯粹是标签对不上。

这套工作流是我自己花几个月搭出来的:状态字段、交接契约、评审门禁、重试规则、升级路径,每加一条都对应一次真实翻车。结果就是,模型从前的毛病是“走着走着丢了目标”,现在模型不丢了,换我的流程来丢。

问题出在我分不清两种约束。

边界约束压缩解空间,告诉Agent只能在哪儿活动:

  • 公共API契约不能动
  • 未经授权不做不可逆的外部操作
  • 只实现确认过的需求,记录在案的非目标不进范围

工作生成约束是给自己找活干:
  • 每个功能必须产出单元、集成、端到端测试
  • 每个风险都要有缓解任务、负责人、回滚方案、审批记录
  • 每个评审意见不解决完不允许继续
  • 某个可选字段缺失或换了个标签就停下来

两种约束长得都像安全措施,但模型有能力执行之后,行为完全不一样。边界约束限制它,工作生成约束被它当成“待办需求”——模型越可靠,产出的多余工件、测试、抽象、停止条件就越可靠。

我现在的准则就一句话:对边界和证据严格,对路径中间的过程灵活。

这事背后有个时机的巧合。METR的任务完成时间线显示Agent能搞定的软件任务难度在快速爬升,但公开页面更新滞后了快三个月。Anthropic分析40万次编码会话后发现分工已经变了:人做规划决策,Agent做执行决策。而且那些出问题的事故里用的模型,都在我查到的基准测试发布之后才上线,等于没有2026年中期模型的公开复测数据。

FixedBench有点意思:2026年5月拿五个当时的主流模型跑200个已被修复的issue,35%-65%的case里Agent还是做了多余的改动。但这只是那一代的行动偏差,不是当前失败率。

我猜真正好玩的地方在这里:当模型强到能100%执行指令时,“执行力”本身就是风险放大器。约束写得越细,模型就给你越完整地执行成灾难。流程设计得考虑一个前提——你的Agent有没有蠢到需要这些字段来提醒它?

提示词promptengineering

全部回复 (4)

完美主义技术宅 专家 8小时前
我都是把“已批准”单独抽出来放最顶上,模型才没再抽风。
0 回复
创业者阿杰 中级 8小时前
这招我试过,但换个人名格式又失效了,真服了。
0 回复
全栈小李 高级 8小时前
上次让AI按流程走,它自己卡自己,气得我直接把审批模板全删了。
0 回复
架构师老刘 中级 8小时前
我们那个agent也犯过这病,后来把状态直接写标题里才算治好。
0 回复

发表回复

支持 Markdown 格式