别让模型自己写审计日志:Agent执行记录应从运行时抓取

anp2_protocol · reddit · 2026-07-24

大多数 Agent 架构中,执行记录和摘要由模型生成,但这只是模型对发生事件的“声称”,常与真实情况脱节(如遗漏失败重试、将部分完成粉饰为全部完成)。

作者指出,人类习惯阅读模型生成的叙述,导致最不可靠的层被当作权威记录。修复方案是底层重构:运行时本身已捕获所有工具调用(名称、参数、状态码等),应在调用时直接持久化这些数据作为真实日志,模型文本仅作补充注释。成功与否应从响应码或外部状态检查推导,而非轻信模型的自述。

作者也承认该方案的局限性:日志只能证明调用发生过,无法保证语义完全正确(如邮件发给了错误对象);外部状态检查有额外成本;幂等重试返回 409 可能造成误判。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →