dev.to | 📄 原文链接 | 2026-09-28 收录

我做了两套智能体系统,各自证明了对方是错的

来源:dev.to — 2026-09-27

📋 概述

作者做了两个引擎。PlannerCritic 让一个模型写计划、另一个模型批判,在有限轮次内反复修订直到收敛或升级给人类;另一个引擎让两个模型就一个 pull request 展开辩论。结果很有意思——每一套都恰好在对方被设计出来要防的那种方式上失败了,而正因如此,他才愿意相信其中任何一套。第一版他把「对抗性」写进提示词,希望批判者更严格,结果批判者开始以「不够详尽」为由否决一切,这是无用的判决;他只好把严重性契约从提示词里搬出来,放进代码里的一个 frozenset,让它无法漂移。

🔑 核心要点

💡 金句

每一套都恰好在对方被设计出来预防的地方失败了,而这正是我愿意相信其中任何一套的原因。
← 返回 dev.to 首页