开源项目 Doberman:双层代理网关,从输出端拦截 AI 越轨

Da_Lil_Fu · reddit · 2026-09-01

开发者 Alan 开源了 AI 安全代理 Doberman,旨在解决输入防护(如防注入)不足的问题。Doberman 作为 LLM 的代理路由器,在输入、输出和工具调用两层设防:第一层拦截明显的恶意操作(删库、泄露密钥);第二层通过学习用户写作风格(Stylometry)动态识别异常行为,防止 AI 发出不符合用户偏好的内容(如帮对手加油)。项目基于 Apache 2.0 协议,目前处于 Alpha 阶段。

所属事件:开源 Doberman:执行层拦截 Agent 越轨动作(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →