开源项目 Doberman:双层代理网关,从输出端拦截 AI 越轨
Da_Lil_Fu · reddit · 2026-09-01
开发者 Alan 开源了 AI 安全代理 Doberman,旨在解决输入防护(如防注入)不足的问题。Doberman 作为 LLM 的代理路由器,在输入、输出和工具调用两层设防:第一层拦截明显的恶意操作(删库、泄露密钥);第二层通过学习用户写作风格(Stylometry)动态识别异常行为,防止 AI 发出不符合用户偏好的内容(如帮对手加油)。项目基于 Apache 2.0 协议,目前处于 Alpha 阶段。
所属事件:开源 Doberman:执行层拦截 Agent 越轨动作(3 条相关)→
「编程与Agent」频道最新
- Anthropic 新模型更新即支持 PowerShell 工具调用 — dfinke · 2026-09-02
- 开源 Reef:把推理服务变成持续自我改进的 Agent 学习引擎 — qinzytech · 2026-09-02
- Agent 软件工程的悖论:工程师应像 GPU 一样思考 — charles_irl · 2026-09-02
- MapQuest 推出 MCP 服务器,为 AI Agent 提供位置与路线能力 — deliprao · 2026-09-02
- Ethan Mollick 提议 Agent 设“促进者”以决定何时介入人工 — rseroter · 2026-09-02
- 用户吐槽 Google Antigravity:Gemini 表现拉胯,一条命令烧掉半份配额 — DigSudden6867 · 2026-09-02