322M 本地小模型审查编码 Agent 每条命令,CPU 仅需 90ms
Extreme_Ad5709 · reddit · 2026-10-11
Reddit 用户发布开源项目 laya-guard:用本地约 322M 参数的小模型(Apache-2.0)在编码 Agent 执行 shell 命令前做安全判定,不依赖付费 API。
- 工作方式:正则策略先拦截已知危险模式(rm -rf /、curl … | sh、泄露密钥、绕过认证);ls、git status、npm test 等简单命令直接放行,但含管道/链式/重定向、-exec 类 flag 或敏感路径的命令仍交给模型;其余命令由模型在 CPU 上约 85–90ms 内给出 allow / review / block。
- 自报成绩:AgentDojo v1(judge 级)拦截 27 次攻击中的 25 次,97 个良性任务保留 92 个;自建 50 条命令集命中 48 条。
- 已知缺陷:训练数据以韩语为主,英文自然语言命令误拦较多;服务挂掉时 hook 默认放行。
- 已提供 Claude Code、Codex CLI、Cursor、Gemini CLI、Copilot CLI 等 11 个 Agent 的 hook,pip install laya-guardrail 即可安装。
所属事件:开源护栏 laya-guard 用 322M 本地小模型拦截 Agent 危险命令(2 条相关)→
「编程与Agent」频道最新
- Synthesia 推出 Syren Video:提示词生成机构级视频,免费试用 — heyshrutimishra · 2026-10-11
- Codex 负责人调侃「完美之日就是只剩重置之时」,小红虎问 OpenAI 靠重置留人? — xiaohu · 2026-10-11
- 一个 MCP 接通 X、Ins、WhatsApp、Telegram 和 Gmail — gauthi3r_XBorg · 2026-10-11
- 开发者用单个 Codex/Claude 会话一天内原生移植世嘉 MD 游戏 — ssh4net · 2026-10-11
- Grok Bot 自动砍价成功:替用户与网络运营商聊出每月省 15 美元 — jarrodwatts · 2026-10-11
- banteg 惊讶发现 Codex 云端无需配置,自动分析仓库搞定环境 — banteg · 2026-10-11