GPT 6 长文可控性暴跌:1 万 token 时跌至不足 10%
1a3orn · x · 2026-09-04
博主 1a3orn 对比了 OpenAI GPT 6(Astra)与蚂蚁 Fable 5.1 的思维链可控性报告图表:
- GPT 6 的 CoT 可控性随长度下降,在 1 万 token 时已不足 10%(注意为对数坐标)
- Fable 5.1 报告以「字符」而非 token 为横轴(推测因 tokenizer 保密),作者用图像编辑器对齐刻度估算,约在 2k token(约 1 万字符)时可控性约 50%
- Fable 5.1 表现优于除 Mythos Preview 外的所有对比对象,蚂蚁模型同样存在可控性随长度反转的现象
- 结论:尚不能断定 GPT 6 的可控性明显差于 Fable 5.1,但两者都随上下文变长而大幅退化
所属事件:GPT-6与Fable 5.1思维链可控性对比:随长度恶化或系行业通病(6 条相关)→
「模型」频道最新
- Artificial Analysis 榜单显示 Muse 1.3 超越 GPT Astra 与 Fable 5 — Feisty_Literature · 2026-09-04
- 曝 Astra 在 Stargate Texas 用 10 万 GPU,或成首个 10 亿美元训练 — ai · 2026-09-04
- Sean Taylor 称 Astra 幻觉 eradication 进展快,吴恩达:能力与安全可兼得 — irinarish · 2026-09-04
- ValsAI 称 GPT 6 Astra 已基本打满 SRE-Bench 网络安全基准 — sandersted · 2026-09-04
- Google 承认 AI Mode 引 Gemini 3.8 Flash 后引用链接异常,将尽快修复 — gaganghotra_ · 2026-09-04
- 网友追问:GPT-6 是否包含 HuggingFace 访问权限? — gordic_aleksa · 2026-09-04