为什么你的 Agent 循环需要独立验证
来源:dev.to — 2026-08-27
📋 概述
作者指出,Agent 循环即使出错也可能报告成功:实现 agent 在跑完自己的检查后就标记任务完成,下游 agent 信任该状态继续构建,失败会一直隐藏到集成或生产才暴露。他主张把完成条件的判定权从实现 agent 手里拿走,交给一个它无法改写的只读验收策略与独立验证者,并给出四值模型与验证者独立性、证据门槛、人工在环等落地建议。
🔑 核心要点
- 当实现 agent 同时决定「何时算完成」,它的完成声明就成了 harness 的停止信号,这是验证缺口
- 验证循环用实现 agent 无法改写的 done condition 评估产物,独立证据支持完成才放行
- 并行 agent 会放大未验证的输出:AgentField 首跑中 30 多个并行 harness 全绿,却藏着跨模块未导出的依赖被 mock 掉的错误
- 四值模型:NO 打回、YES 结束、MAYBE 上报人类、IFF 表示完成等价于某个外部命名条件
- 验证者用隔离上下文只看产物与原始证据,排除实现 agent 的推理与完成声明
- 先用确定性检查,必要时才调验证者 agent;按发布风险匹配证据门槛,高风险需具名人工批准
💡 金句
如果实现 agent 同时也决定工作何时算完成,它的完成声明就会变成你 harness 的停止信号。
👍 0
👎 0
← 返回 dev.to 首页