Agent 栈最小审计层怎么做
SaadUllah45 · reddit · 2026-07-19
作者在受监管环境里做 agent 系统,指出真正阻碍落地的往往不是模型能力,而是无法审计 agent 到底做了什么。
他整理了自己认为的最低可行审计层:
- 不可变执行轨迹:工具调用、检索、推理写入 append-only 存储
- 记录输入而不只是输出:prompt、RAG 后上下文、tool 参数都要保存
- 给模型版本和 prompt 模板做版本绑定,便于复现
- 记录检索来源:chunk、文档、分数
- 让工作流步骤显式化,而不是把逻辑全藏在 system prompt 里
- 运行时强制执行每个 agent 的权限边界
他还问了几个实践问题:大家是用 Langfuse/LangSmith/Phoenix 这类现成工具,还是自己做;多 agent trace 该扁平还是嵌套;以及是否真的遇到过审计或事故复盘。
「编程与Agent」频道最新
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11
- Gergely Orosz 观察:AI Agent 提速十倍交付,却带来一堆小退化 — ducha_aiki · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11