实测与工具边界:模型提议,系统执行
两篇实践文章聚焦 AI agent 的工具调用安全:一篇通过 192 次本地实测论证,即使模型生成完全合法的工具调用,授权与否也不应由模型自行决定,应遵循"模型提议、系统执行"原则;另一篇为 LangGraph agent 构建了确定性工具执行边界 CLIM Agent Guard,在 44 次注入测试中全部拦截危险删除操作,作者还公开挑战全网尝试绕过。
2026-10-09 ~ 2026-10-09 · 3 条相关
- 一行推导看穿 REINFORCE:策略梯度即奖励加权似然 — le_james94 · 2026-10-09
- 用模型规划会主动找出模型最讨喜的错误 — le_james94 · 2026-10-09
- 三周刷完斯坦福AA203全部19讲:最优控制到PPO的深度复盘 — le_james94 · 2026-10-09