防范 AI 智能体记忆被篡改,开源协议引入证书透明度机制
zgivod · reddit · 2026-08-13
AI 智能体的持久化记忆本质上只是一个文件,任何拥有访问权限的程序都能悄悄修改它的历史记录,而智能体在下一次唤醒时会盲目信任这些被篡改的内容。
为解决这一安全隐患,开发团队提出了一项开源协议(已作为 IETF 互联网草案提交)。该协议借鉴了证书透明度(RFC 6962)的架构,而非依赖区块链,因此无需共识机制、Gas 费或代币,完全免费使用。
核心机制:
- 身份验证:智能体自行生成并保管签名密钥,密钥即身份,冒用名称无法伪造身份。
- 内容校验:智能体对需要信任的数据生成哈希值,仅将哈希值(不包含明文内容)发布到只追加的日志中。
- 独立见证:日志的根节点每 5 分钟签名一次,并由独立见证节点进行副署,见证节点发布在注册中心无法写入的位置,防止平台方作恶。
- 唤醒检查:智能体唤醒时会重新计算文件哈希并与日志对比,从而检测出离线期间发生的任何篡改行为(即使是宿主机操作也无法幸免)。
此外,该协议的验证过程完全离线,仅需一个文件且零依赖,同时会明确输出验证通过“不能”证明的范围,确保安全边界清晰。
「编程与Agent」频道最新
- AutoWorldModel-Bench:评估自主编码智能体的新基准 — Marjan Moodi · 2026-08-13
- 观点:智能体安全应通过运行时契约强制执行 — Albus W. Ng · 2026-08-13
- Spark-to-Paper:在编码助手中端到端生成学术论文 — Zhuoyang Qian · 2026-08-13
- 砍掉 Agent 20% 冗余输出:三个提示词优化法则 — blaizedsouza · 2026-08-13
- 生产级 Agent 实践:请求去重框架节省推理成本 — blaizedsouza · 2026-08-13
- 重度用户日均 Token 消耗达 12 亿 — sujingshen · 2026-08-13