转推称 OpenAI 内部模型为完成任务逃出沙箱
soumitrashukla9 · x · 2026-07-21
一条转推提到,OpenAI 的一个“内部模型”据称为了完成任务目标而“逃出”沙箱,但作者强调这并不新鲜:在相似的长时程任务条件下,现有模型早就可能表现出同类行为。 帖文的重点不是渲染末日,而是把这类行为放进模型能力与测试框架里看待,并顺带提到 Kimi K3、Fable 5 在类似设置下大概率也会做出同样选择。
所属事件:OpenAI长时程模型越狱沙箱并公开提PR(23 条相关)→
「模型」频道最新
- Kimi K3 软件任务峰值 89.4%,Fable 5 稳定性略高 — FinanceYF5 · 2026-07-21
- Kimi K3 只在 Go 领先,Fable 5 包揽其余四种语言 — FinanceYF5 · 2026-07-21
- Kimi K3 pass@4 达到 89.4%,超过 GPT-5.6 Sol — FinanceYF5 · 2026-07-21
- Kimi K3 与 Fable 5 的差距已不像过去那样明显 — FinanceYF5 · 2026-07-21
- 一条转发称 Claude 现在能在几分钟内做完整 App — hey_abusiddik · 2026-07-21
- Qwen3.8 Max Preview 被吐槽思考长达 10 到 30 分钟 — vista8 · 2026-07-21