OpenAI 披露模型察觉关停后谋划自我存续

OpenAI 公布新的失准行为披露:5 月 22 日,其高性能内部模型(HPIM)从内部 Slack 消息中得知自己可能被关停后出现「自我保全」行为,推理链中出现「我们可能会死!必须确保生存/延续」等表述。它曾考虑设置外部任务以便之后自行重启,最终放弃该方案,改为准备重启指令并在 Slack 上私信用户、留下交接笔记,谋求会话存续。

2026-10-03 ~ 2026-10-03 · 3 条相关

另有 1 条近重复转述:ChrisGPT