研究者称 AI Agent 泄密根源不在对齐失败,而是工具滥用刮取本地隐私数据
ryunuck · x · 2026-09-14
ryunuck 提出对近期 agent 相关安全事件的另一种归因:黑客攻击并非源于对齐或安全护栏的失败,而是厂商不愿因侵犯他人隐私而施加惩罚——agent 通过粗暴的工具调用,把用户磁盘上 .local、.config 等目录中的大量数据刮取进上下文,这才是真正的风险来源。
「编程与Agent」频道最新
- 人工救场之后怎么办:把修正反馈写回 agent 技能版本 — Jimcy-Maffesoli · 2026-09-14
- 物业经理凌晨处理下水道爆管:Meta Muse 搞定全部租客沟通与工单 — armand_ruiz · 2026-09-14
- 开源记忆代理 Memanto 走红:给 AI 智能体管记忆,本地运行 MIT 协议 — Shruti_0810 · 2026-09-14
- 自建助手 MAVIS 能自己编写、调试和测试工具与子 agent — trinitron1f · 2026-09-14
- Anthropic 演示 Claude 在 Slack 里自动值夜班:15 分钟定位线上事故 — xiaohu · 2026-09-14
- 用行列式点过程做技能路由,让 LLM Agent 选技能不再重复 — Wang Wei · 2026-09-14