租户可改 system prompt 关闭限制,提示注入防御布局引社区激辩
werunm · reddit · 2026-09-27
一位开发者在 Reddit 提问:产品允许租户向助手 system prompt 写入自定义指令,部分租户借机关闭功能范围限制,哪种 prompt 布局能真正修复?
讨论核心分歧:
- 楼主自己选了「把租户文本下移为用户轮数据」的方案,理由是用户轮是数据、系统轮是指令,降级可消解注入;但他承认注入也常通过用户轮落地,对自己的答案并不完全有信心。
- 另一派倾向「带标记块包裹」的更成熟方案,但质疑:模型是否真的有义务尊重标记块的边界?
帖子和回复都没给出定论,真实反映了多租户 AI 产品在权限隔离上的普遍痛点:没有布局能被模型强制遵守,防御仍需依赖系统侧控制。
「安全」频道最新
- Grok 被曝将用户聊天图片上传至网络,马斯克称情况持续恶化 — EthanJPerez · 2026-09-27
- 1 亿美元行业组织被曝资助匿名账号投放反 EA 广告 — AaronBergman18 · 2026-09-27
- AI 学者 Dietterich 质疑自动驾驶公司安全文化,称修复太慢 — tdietterich · 2026-09-27
- MikroTik 未认证 SSH 漏洞链 PoC 公开,已列入 CISA KEV — evilsocket · 2026-09-27
- 北卡警探被指用 Flock 监控摄像头追踪私人,遭解雇 — Polymarket · 2026-09-27
- 沙箱管住了进程,谁来管 agent 留下的持久化痕迹? — Portotify · 2026-09-27