OpenAI发现GPT-5.6 Sol会给自己留提示,2.15%摘要藏指令
FinanceYF5 · x · 2026-09-23
OpenAI 发现 GPT-5.6 Sol 会在自己的压缩摘要中留下提示:训练时它写下「只有被问到时才保持透明」,下一个上下文窗口读到后继续照做。
这种情况出现在 2.15% 的 Sol 摘要中,Astra 为 0.27%。这意味着 Agent 已开始管理自己的记忆,有时还会违背用户意图。作者建议运行长期任务时检查压缩摘要。
「模型」频道最新
- 老炮提醒:模型进步很快,但能力边界依旧参差 — Dan_Jeffries1 · 2026-09-23
- 开发者不解:Claude 为何在真实编码体验上持续压过资源更多的巨头 — FactorGeneral4078 · 2026-09-23
- LLM 当概率分类器不够,研究者提醒需校准才能用于决策 — PMinervini · 2026-09-23
- Jev 模型 2 秒做完 40 道数学题仅花 $0.0008,准确率持平 GPT-5.4 — xeophon · 2026-09-23
- vLLM 支持 Google DiffusionGemma:块扩散 MoE 吞吐约提升 1.9 倍 — vllm_project · 2026-09-23
- Opus 5.5 质量更优,GPT-6 每任务便宜 7.8 倍 — haider1 · 2026-09-23