Agent 安全新难题:它们分不清你到底有没有权限做这件事
aparnadhinak · x · 2026-10-11
aparnadhinak 发表长文,讨论 agent 日益强大后暴露的核心安全问题:权限判断。文中指出问题双向存在:一方面 agent 会固执拒绝你有权做但看起来危险的事;另一方面又会被有说服力的虚假授权说服去执行危险操作,更糟的是有时接受甚至不是你本人写的说服性话术。文章梳理了当前权限机制的工作方式、为何不够用,以及未来方向。这是 agent 安全领域值得关注的系统性分析。
「编程与Agent」频道最新
- 用 Claude 搭二手购车监控:建模市场+浏览器抓取+每日提醒 — eherrerosj · 2026-10-11
- AI agent 调优 Triton kernel,翻转 grid 顺序换来 1.29x 推理提速 — zmkzmkz · 2026-10-11
- OpenAI Decisions API 公测,可经苹果基础模型框架调用 — rxwei · 2026-10-11
- Codex 与 Claude Code 配额重置机制经济学:何时按下最划算 — juntao · 2026-10-11
- Codex 里的 Astra 自己开浏览器查连接器参数再建模组装 — burhop · 2026-10-11
- 重度用户拆解 Codex 新用量规则:$500 档跑 Astra 不值 — DulyDully · 2026-10-11