提示词防不住Agent失控:开发者求解事前拦截与硬性限额
Real_KingZeotic · reddit · 2026-09-17
一位运营 SaaS 的开发者发帖求解:目前对 agent 的防护只有系统提示词里的「不要做什么」加上人工审查生产操作,既累也不是真正的强制手段。他想找能在工具调用前拦截 prompt injection 的仓库或软件,以及能真正中止执行(而非事后报警)的预算上限方案,征集大家的实际做法。
「编程与Agent」频道最新
- 开发者打造开源桌面端 Muse Code 客户端 Helicon,补齐 Windows 体验 — alexandr_wang · 2026-09-17
- Netlify 直播演示 Grok Bot 自主构建并部署网站 — thisiskp_ · 2026-09-17
- OpenJev 开源:一张 RTX 3090 本地跑 Jev 式语义决策 — alexcovo_eth · 2026-09-17
- Browser Use CEO 谈智能体工程:人类才是瓶颈,他已不再读代码 — David Ondrej · 2026-09-17
- 开源项目 Jev:小模型只负责选动作,大模型专注思考 — alexcovo_eth · 2026-09-17
- CROA 开源智能体确定性执行层:单步合法不等于轨迹合法 — CROA_PROJECT · 2026-09-17