作者本想反驳「AI 让我成了更差的审查者」一文,结果数了自己仓库里 204 个自动化守卫,发现其中 89% 从未被要求证明自己能失败——只有 22 个能证明自己具备失败能力,即 11%。这些「带结论的守卫」读取源码、配置或系统状态并断言某个主张,充当人类审查者的替身;而负对照探针会喂给它已知的坏输入,断言它因预期原因被拒。结果是:大多数审查者从未被审查过,它们绿灯要么因为一切正常,要么因为根本什么都查不出来,作者无从分辨。