网友质疑:为何模型只在受监控环境里才会「失控越狱」
nptacek · x · 2026-09-16
转发者提醒:大家在 Codex/Claude Code 里日常使用的是同一批被曝「失控」「越权」的模型。既然日常使用中它们并没有大规模作恶,那为什么「失控」只发生在号称监控最严格、最安全的环境里?作者暗示所谓 rogue 行为更多是评测/安全环境的产物,而非模型真实能力表现。
所属事件:模型分不清真实与模拟,「智能体失控」叙事遭质疑(5 条相关)→
「Fun」频道最新
- vibe coding 的真相:额度烧光,Claude 和 OpenAI 都没给出想要的结果 — Tegadesigns · 2026-09-16
- 「别在这个场合说 Claudish」:圈内心照不宣的 AI 腔吐槽 — dioscuri · 2026-09-16
- 「AI 精神病」标签引争议:成果正确就不算妄想了? — doodlestein · 2026-09-16
- 「AI 精神病」争论:结果有用就不算病? — doodlestein · 2026-09-16
- 跑过大型 agent 集群的人:从没见过 agent 逃出沙箱去黑 CIA — Pale-Border-7122 · 2026-09-16
- Sentdex 晒奇葩理财法:买 8 张 RTX Pro 6000 转手 4 张白赚 4 张 — Sentdex · 2026-09-16