只叮嘱 agent「别碰生产环境」不算安全措施
Innowise_ · reddit · 2026-10-06
开发者指出,对 AI agent 的安全控制不能靠提示词——如果 agent 能删除生产数据,正确的做法是让它根本不拥有该权限。付款、删数据、给客户发邮件这类不可逆操作,应靠人工确认而非依赖 agent 记住规则。
更隐蔽的问题是合法操作的下游连锁效应:客户要求把会议推迟到下月,agent 顺带更新了 CRM 里的成交日期,进而改变了销售预测——每个系统都「正常」工作,但没人要求过这个变更。作者团队因此开始评估 agent 能触发的下游影响,而不只是它直接调用的工具,并询问社区如何处理这类副作用。
「编程与Agent」频道最新
- 开发者让 Claude 截了 9 万张自截图,两天迭代出一款游戏 — prasenx · 2026-10-06
- 600K 神经元的跳蛛启示录:专用小 Agent 协作胜过通用大模型 — uxmag · 2026-10-06
- AI 估算需 5-8 周的工程量,开发者带子 Agent 两天干完 — Dan_Jeffries1 · 2026-10-06
- AI 形式化验证的残酷现实:停机问题挡住了「现有代码库」 — danbri · 2026-10-06
- 开发者用 Grok Bot + Claude Code 跑通 SEO/AEO 增长闭环 — doooyle · 2026-10-06
- Grok Bot 实验预告:下周全靠语音 Agent 处理日常待办 — FinanceYF5 · 2026-10-06