机器人大战,但你的机器人是智能体框架
来源:dev.to — 2026-09-03
📋 概述
作者为智能体搭建了一座「竞技场」:两台 AI 智能体在一个 110 节点、110 节点的网络拓扑上实时对战,红方埋设并引爆针对节点的破坏(cascade 会扩散),蓝方只看到症状而症状会说谎——最响亮的节点几乎从不是元凶。他本想演示级联失败,结果十分钟后发现自己写的是个战争游戏:欺骗、佯攻、红方明知现在无法引爆就故意铺假线索、蓝方像省弹药一样精打细算每步。最有趣的是,Claude Opus 5 拒绝当进攻方,Kimi K3 则毫不犹豫接手。作者指出,决定胜负的不是模型有多聪明,而是 harness——给每个智能体加了六十行「每回合写给自己的私密笔记」,棋力立刻质变。
🔑 核心要点
- 红方要埋设并等待约 30 秒布防后再引爆,一次爆炸能把负载倾泻给邻居乃至连锁击垮整片区域;蓝方永远看不见攻击,只看到会说谎的症状——被引爆的节点卸掉负载后读数健康,被杀死的邻居反而大声呼救
- 游戏全通过工具调用进行,双方都不收到任何像素;观众能看到双方都看不见的 ground truth,看蓝方自信地隔离地图上错误的一半
- Opus 5 以 content filter 稳定拒绝攻击手框架且 usage: null(连账单都不产生);一个拒绝和一个空回复在没读 finish reason 时长得一模一样——作者调了两小时 max tokens
- 六十行私密笔记带来质变:Kimi 会规划「槽满且要到 t=31 才可引爆,先在 44-65 区埋假线索」;Claude 会省步数等真证据;双方甚至在不互相可见的情况下独立选中同一个枢纽节点——框架没让模型更聪明,只是给了它的聪明一个落脚处
- 两条各耗一天的教训:规则智能体看不见就不算规则,误导性错误字符串让红方永久尝试错误节点;失败与拒绝从外部看一模一样,要单独记录 empty/truncated/refused 三类 finish reason
- 作者真正的论点是值得看的锦标赛是 harness 对 harness——同一引擎,差异全在你为它搭建的记忆、告知的对手信息、让它在脑中保有多少棋盘、给了它放计划的什么地方
💡 金句
在断定你的智能体不擅长这游戏之前,先检查这游戏有没有对它说真话。
👍 0
👎 0
← 返回 dev.to 首页