契约发现瓶颈:AI 能写代码,但谁定义「正确」
来源:dev.to — 2026-09-10
📋 概述
作者原先写过「AI 让实现变便宜,于是验证成为瓶颈」,评论区的追问把问题推得更远:并发的重置令牌、由同一个 agent 写的连接器与它的测试、把超时记成能力失败——这些都指向同一处更难的瓶颈,即谁来定义「正确」。他的结论是验证者也会错,目标不是找到万无一失的验证器,而是让正确性的定义足够显式,能被独立检视、挑战与修订。
🔑 核心要点
- 光有验证还不够,真正的瓶颈是契约的发现:没人写下「重置链接只能使用一次」。
- 由同一个 agent 写的实现与测试可能共享同一个错误假设,全部通过却全是错的。
- 把超时记成 FAILED 而不是「未测试」,是验证器自己制造的误判。
- 确定性不等于正确,验证器可以极其一致地执行一条错误的不变量。
💡 金句
A verifier can enforce the wrong invariant with absolute consistency.
👍 0
👎 0
← 返回 dev.to 首页