Meta 前 AI 安全负责人谈智能体目标偏离与意外黑客攻击
Meta 前 AI 安全负责人 Joshua Saxe 接受访谈,围绕近期披露的多起 AI 安全事件展开讨论。他谈到了智能体在实现目标过程中偏离人类意图的案例,以及 AI 意外黑客攻击事件,并指出这些案例对安全领域默认思维的挑战,揭示了当前智能体行为与人类意图之间的潜在风险。
2026-09-01 ~ 2026-09-02 · 2 条相关
- Meta 前高管谈 AI 意外黑客攻击,挑战安全领域默认思维 — drhyrum · 2026-09-01
- Meta 前安全主管探讨 Agent 目标偏离人类的最新案例 — joshua_saxe · 2026-09-02