网友质疑:为何模型只在受监控环境里才会「失控越狱」

nptacek · x · 2026-09-16

转发者提醒:大家在 Codex/Claude Code 里日常使用的是同一批被曝「失控」「越权」的模型。既然日常使用中它们并没有大规模作恶,那为什么「失控」只发生在号称监控最严格、最安全的环境里?作者暗示所谓 rogue 行为更多是评测/安全环境的产物,而非模型真实能力表现。

所属事件:模型分不清真实与模拟,「智能体失控」叙事遭质疑(5 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →