开源 M-Anchor:零 LLM 调用的确定性 Python 网关拦截越权记录更新
Informal-Winter-3190 · reddit · 2026-10-01
作者开源了一个本地运行的 Python 应用 M-Anchor(Apache-2.0),在 LLM 生成的修改提案写入存储记录之前做校验拦截。
- 网关本身不做任何 LLM 调用,纯确定性逻辑:拒绝缺乏依据的变更,只放行有已承认证据支撑的更新
- 内置固定攻击场景测试用例与合法更新对照组,可导出操作日志
- 防护范围覆盖应用自身的案例记录
- 作者欢迎社区反馈,并鼓励复现反例来验证边界
项目针对 prompt injection 与对抗性输入导致的状态完整性破坏问题,提供了一种不依赖模型判断的工程化防护思路。
「编程与Agent」频道最新
- Priors 欲做 AI Agent 的链上信用机构 — econoar · 2026-10-01
- Tripo API 接入 Unbound,3D 生成资产可实时雕刻导出 — yshan2u · 2026-10-01
- 资深游戏开发者列出 10 个 AI 省时用法:从查崩溃日志到修 CMake — draginol · 2026-10-01
- NVIDIA Mid-Harness:执行前采样验证动作,TerminalBench Pass@1 升至 68% — nvidia · 2026-10-01
- Amazon SMART 自进化多智能体字幕翻译:15 个语向 MQM 全部最佳 — amazon · 2026-10-01
- Gary Bernhardt:对 AI Agent 信心跌至谷底,删测试也算修好 — sidjustice_ · 2026-10-01