圈内对比 CoT 可控性:Fable 5.1 或与 Astra 不相上下
Miles_Brundage · x · 2026-09-04
tenobrus 转发讨论称,Fable 5.1 在思维链(CoT)可控性上很可能与 Astra 持平,并引一段示例展示其在极少字符内实现的控制效果。围绕两家前沿模型 CoT 可控性的横向对比观察。
所属事件:GPT-6 与 Fable 5.1 思维链可控性对比引争议(7 条相关)→
「模型」频道最新
- Gary Marcus 预测:新模型确有改进,但将再现刷榜式锯齿短板 — GaryMarcus · 2026-09-04
- GPT-6 Astra 登顶代码迁移基准,68% 准确率领先第二名 10 分 — sandersted · 2026-09-04
- 吴恩达调侃前沿模型太弱:来跟我聊聊,问题会让它们宕机 — andrewgwils · 2026-09-04
- Epoch AI 发布 FrontierMath Erdős 基准,Astra 以 2/68 居首 — keviv9 · 2026-09-04
- OpenAI 发布 GPT-6 Astra:ARC-AGI-3 得 99.9%,但独立评测泼冷水 — Latent Space · 2026-09-04
- Liquid 发布 Nanos 系列:350M-2.6B 专用小模型主打端侧 Agent — JosephJacks_ · 2026-09-04