资讯 · 改写稿
拦得住、也证得清:Agent 治理和可观测性差在哪
结论先给:可观测性只能告诉你发生了什么,拦不住错误、也交不出证据。来源在 AWS 上实测治理链路时发现:他写的两条策略什么都没拦住——不是因为配错,而是那两类策略在这个 Agent 里结构上就没有可匹配的信号。
来源(dev.to,AWS Community Builders)用一句话划清了两层:可观测性回答「Agent 做了什么、花了多少」;治理回答更难的一对问题——「我能不能拦住它做错事」以及「我能不能证明发生了什么」。来源说,一条 trace 只给你第一层。
对确定性服务来说,治理基本就是访问控制加输入校验,两者都在开工前于边界处强制执行。而 AI Agent 打破了这个前提:它自己决定控制流,于是边界变得模糊。
他搭了什么
来源在 Amazon Bedrock 上搭了一个合成的多 Agent 贷款决策 crew,接上 Traccia,目标是让四件事在真实基础设施上发生:
- 提示注入在任何模型调用之前被硬拦;
- 申请人的个人信息在每个子 Agent 的 trace 里被脱敏;
- 每个 span 都盖上 EU AI Act 的证据戳;
- 平台拒绝一个失控 Agent,并给出可引用的裁决。
结果:两条策略什么都没拦
来源坦承结果不完美:他写的两条策略没有拦下任何东西,而且不是因为配置错误——三种策略类型里有两种在这个 crew 里结构上就没有可匹配的信号。来源说,搞清楚为什么,才是这篇文章最有用的部分,因为这是「没人写下来」的那一段。
数字与口径
来源交代得很细:运行环境是 Amazon Nova Pro(us-east-1 按需)+ Strands Agents,观测组件 traccia 0.1.29 的价格为 $0.0008 / 1K 输入 与 $0.0032 / 1K 输出;EU AI Act 附件三的信用评分义务适用日期是 2027-12-02;演示系统全程合成,产出的是 evidence(证据)而不是 compliance(合规)。
本站计算——把 traccia 的单价换成常用口径:$0.0008/1K 输入 ≈ $0.80/百万输入 token,$0.0032/1K 输出 ≈ $3.20/百万输出 token。再看日期:从 2026-10-08 到 2027-12-02 约 14 个月——这正是来源所说「现在值得动手」的时间窗。
它没做什么
来源明确区分了「产出证据」与「达成合规」:这套链路能给你可引用的裁决记录,但不等于合规结论。他还提到 $0 的 SDK 层不需要账号,而带强制执行与治理中枢的平台层有 14 天免费试用——这也是他把整套流程做成「零成本可复现」的原因。
把可观测性当治理:trace 能记录,但拦不住。
以为策略没生效就是配错了:来源的两条策略是「结构上没有可匹配信号」。
把证据当合规结论:来源强调产出的是 evidence,不是 compliance。
自检清单
常见问题
治理和可观测性有什么区别?
来源的划分是:可观测性回答「Agent 做了什么、花了多少」;治理回答「能不能拦住它做错事」以及「能不能证明发生了什么」。一条 trace 只能覆盖前者。
来源实测的结论是什么?
他写了四条目标,其中两条策略没有拦下任何东西,原因不是配置错误,而是三种策略类型里有两种在该 crew 中结构上没有可匹配的信号。
涉及哪些价格与日期?
来源称 traccia 0.1.29 为 $0.0008/1K 输入、$0.0032/1K 输出;EU AI Act 附件三的信用评分义务适用日期为 2027-12-02。
它产出的是合规结论吗?
来源强调产出的是证据(evidence)而非合规(compliance),演示系统全程为合成数据。
来源参考
以上为外部来源;本文为 RefHub 用自己的结构重写,事实以来源页为准,价格与政策会变,请回源核对当日。
下一步:提示注入为什么难防,读 提示注入与 SQL 注入;给 Agent 设执行边界,见 执行容器。