限制提示注入爆炸半径:从零权限默认架构做起
AccBalanced · x · 2026-10-02
manicode 发推指出,限制 prompt injection 影响范围的第一要务,是让模型默认从「零权限」架构起步——即默认不授予任何权限,再按需最小化开放,而非事后修补。
「安全」频道最新
- OpenRouter 自查发现 85 名员工挂千余枚 API 密钥,推出安全中心 — AccBalanced · 2026-10-02
- open weights 被称危险?网友:历次「危险」技术都动了信息控制 — 0xAllen_ · 2026-10-02
- 无审查版 Abliterated Large V2 上线 Venice,面向安全研究匿名开放 — 0xAllen_ · 2026-10-02
- 微软 2026 数字防御报告:AI 加速攻击手法,52.2% 入侵追窃更多凭证 — AccBalanced · 2026-10-02
- Meta Muse 可接入 Tailscale 网络当节点,权限管控照常生效 — AccBalanced · 2026-10-02
- 牛津经济学家呼吁立法确立「学习权」:谁拥有 AI 学到的知识 — carlbfrey · 2026-10-02