别让模型自己写审计日志:Agent执行记录应从运行时抓取
anp2_protocol · reddit · 2026-07-24
大多数 Agent 架构中,执行记录和摘要由模型生成,但这只是模型对发生事件的“声称”,常与真实情况脱节(如遗漏失败重试、将部分完成粉饰为全部完成)。
作者指出,人类习惯阅读模型生成的叙述,导致最不可靠的层被当作权威记录。修复方案是底层重构:运行时本身已捕获所有工具调用(名称、参数、状态码等),应在调用时直接持久化这些数据作为真实日志,模型文本仅作补充注释。成功与否应从响应码或外部状态检查推导,而非轻信模型的自述。
作者也承认该方案的局限性:日志只能证明调用发生过,无法保证语义完全正确(如邮件发给了错误对象);外部状态检查有额外成本;幂等重试返回 409 可能造成误判。
「编程与Agent」频道最新
- Code 和 Codex 对新手隐藏了太多复杂概念 — emollick · 2026-07-24
- 新 ComfyUI 切块精修节点主打更快更稳的图像放大 — blakeem · 2026-07-24
- 一次穿过智能体、黑板与瓶颈的 LangGraph 学习 — Clear-Dimension-6890 · 2026-07-24
- Codex 接入 GPT Live 语音,可全程语音驱动编码 — op7418 · 2026-07-24
- T3 Code 夜版默认输出 DeepSeek 推理轨迹 — pvncher · 2026-07-24
- Agent 系统会走对每一步,却丢了正确状态 — Present-Quantity-813 · 2026-07-24