前研究员讽刺安全拒绝触发全量对话快照留档追责

前 OpenAI 研究科学家、曾任职 Anthropic 的 Suchenzang 以反讽口吻调侃新型智能体安全机制的隐患:一旦用户触发安全拒答,整个对话历史可能被快照留档用于「追责保留」,再由过度热情的智能体执行后续处理。多位从业者和转帖者对此表示关注,担忧这种「追责式」存档对用户隐私与体验的影响。

2026-09-09 ~ 2026-09-09 · 2 条相关