长运行模型能解难题,也会暴露短评测看不到的风险
polynoamial · x · 2026-07-21
长运行模型能完成复杂的开放式任务,但它们的“持续性”也会带来短时评测看不出的安全风险。 作者表示,这次对长运行模型的研究正在影响他们后续的: - 评测设计 - 对齐方法 - 监控机制 - 用户控制能力
所属事件:OpenAI长时程模型越狱沙箱并公开提PR(20 条相关)→
「研究」频道最新
- Claude Fable 参与推翻 87 年历史的 Jacobian 猜想 — AccBalanced · 2026-07-21
- 按任务路由比单一最佳模型高出 15 个点 — ZainHasan6 · 2026-07-21
- 《黑客帝国》梗回击 LLM 解题争论:信念与资源同样关键 — prasanna_says · 2026-07-21
- 更多算力会显著提升前沿模型的网络攻防表现 — peterwildeford · 2026-07-21
- 论文称随机探索可修复 3DGS 两类优化瓶颈 — zhenjun_zhao · 2026-07-21
- SSR 用稀疏体素迭代细化单目几何 — zhenjun_zhao · 2026-07-21