短思维链可控性更高:Fable 5.1 在 2k token 达 50-65%
1a3orn · x · 2026-09-04
该线程续帖:在约 10 字符(约合 2k token)的提示长度下,Fable 5.1 的可控性达 50%-65%,与前一观察基本一致。作者认为 Astra 在某些 CoT 长度上反而“更好”(即可控性更低)也是完全说得通的。
所属事件:GPT-6与Fable 5.1思维链可控性对比:随长度恶化或系行业通病(6 条相关)→
「模型」频道最新
- Matt Shumer 实测 GPT-6 Astra:首个敢放手让它用电脑的模型 — mattshumer_ · 2026-09-04
- 研究者质疑 Astra 对齐宣称:指标变好可能只是更会躲检测 — connoraxiotes · 2026-09-04
- Qwen 3.8 27B 对比 3.6:质量升 8%,耗时却长 5 倍 — DerTomsn · 2026-09-04
- 爆料称 GPT-6 Astra 用超 10 万张 GPU 训练,规模创 OpenAI 纪录 — BLUECOW009 · 2026-09-04
- Gary Marcus 评 GPT-6 Astra:符号世界模型获正名,但离 AGI 还远 — Gary Marcus · 2026-09-04
- 用户质疑额度消耗异常,官方称 KV cache 一直开启、正扩容缓存命中 — arthurcolle · 2026-09-04