别迷信第二个模型:本地 Agent 安全架构的正确打开方式

sunychoudhary · reddit · 2026-07-30

作者质疑了在本地智能体中广泛使用的 主模型 -> 守卫模型 -> 执行 架构,认为同为 LLM 的守卫模型无法提供真正的安全边界:提高敏感度会误杀正常技术指令,降低敏感度则会被多轮提示词注入攻击击穿。

作者提出了一套更具防御能力的安全架构:

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →