AWS 上的智能体治理:真能拦下失控的智能体,并拿出 EU AI Act 证据吗
来源:dev.to — 2026-09-29
📋 概述
作者在 Amazon Bedrock 上搭了一支合成多智能体贷款审批小队,并用 Traccia 做了四件事:在任何模型调用之前硬阻断提示注入、在所有子智能体的追踪里脱敏申请人 PII、给每个 span 打上 EU AI Act 证据戳、以及平台真的拒绝一个失控的智能体并给出带引用的裁决。可观测性只能「看」——它告诉他某个智能体批准了一笔本该拒绝的贷款、某个 run 把申请人邮箱漏进了日志,然后什么也没做。更值得读的是失败部分:他写的三条治理策略有两条什么都没拦住,而且不是配置错误,而是这两类策略在这个 crew 里结构性地没有可匹配的信号。
🔑 核心要点
- 可观测性能发现问题但无法阻止坏 run,也无法事后给监管者交出材料,这正是第二部分要补的缺口。
- 提示注入在任何模型调用之前就被硬阻断,比事后告警更接近真实防护。
- 两条策略没有拦到东西的原因被作者称为「没人写下来的部分」:这些策略类型在这个架构里根本没有信号可匹配。
- 作者刻意区分 evidence(证据)与 compliance(合规):这套东西产出的是证据,不是合规结论。
💡 金句
可观测性告诉我智能体批准了一笔本该拒绝的贷款,然后它什么也没做,因为观察是它唯一会做的事。
👍 0
👎 0
← 返回 dev.to 首页