Claude Code 把持久记忆文件称作「我的笔记」,引安全机制讨论
Strange-Ball1765 · reddit · 2026-09-12
一位用户发现,Claude Code 会话中的持久记忆文件被外部工具按其指示修改后,Claude 察觉到变化并称该文件是「直接在磁盘上被改的,不是我改的」,把这次修改描述为「对记忆文件的注入」,还把它叫做「我的笔记」。
令人意外的是模型区分了「通过我做的修改」与「用户或其他工具直接做的修改」,俨然对文件有某种主权意识。作者想弄清这是有意的来源验证/安全设计,还是模型错误地将记忆文件当成了自己的领地,希望得到技术层面的解读。
「模型」频道最新
- 网传 OpenAI 内部模型 Bel 已攻克纳维-斯托克斯方程,未获证实 — imjustnewatai · 2026-09-12
- DeepSeek v4.1 Flash 称达前沿级安全检测,成本仅闭源模型 1/15 — andreamichi · 2026-09-12
- 称 DeepSeek v4.1 Flash 开源安全检测达前沿水平,成本仅 1/15 — andreamichi · 2026-09-12
- 中国模型连续19周霸榜OpenRouter用量,Google预测合约单日暴跌96% — adrianscottcom · 2026-09-12
- Astra 拒绝审计本地个人项目,安全护栏误伤引发讨论 — Rough-Ad9850 · 2026-09-12
- 智元机器人发布 GE-Act 2.0:首个原生世界动作模型,成功率随数据百倍扩展 — KrishRShah · 2026-09-12