Fable 用合成推理轨迹突破任务瓶颈,GLM 5.3 效仿
mariofilhoml · x · 2026-08-23
用户 Mario 引用了 ProximalHQ 关于 Fable 模型在 FrogsGame 任务中表现的发现,并指出 GLM 5.3 和 Grok 4.6 似乎也采用了类似思路。
- Fable 的突破:通过合成推理轨迹(synthetic reasoning traces),将 Qwen3-8B 在 FrogsGame 后训练任务中的解决率从基准的 3.8% 提升至 67.8%,远超 Opus 4.8。
- 核心方法:Fable 编写了一个回溯求解器,并将求解器的动作过程“语言化”为推理轨迹,以此来训练模型。
- 行业跟进:用户观察到 GLM 5.3 和 Grok 4.6 在同类任务上的表现提升,推测其可能使用了相同的技术思路。
「模型」频道最新
- Anthropic 将用 SynthID 隐形水印 Claude 输出 — every · 2026-08-23
- Arena神秘模型「adamant-ananke」实锤:GLM 后训练加成版 — ChrisGPT · 2026-08-23
- DeepSeek Flash 视觉版实测:比 Luna 强且价格仅其四分之一 — bindureddy · 2026-08-23
- Qwen3.8 27B 推出无审查 GGUF 版:262k 上下文实测 — BLUECOW009 · 2026-08-23
- 实测 Gemini 3.7/3.6 Flash 编程能力表现 — YogurtNo349 · 2026-08-23
- Qwen 3.8 27B 跑分 91.9 中位 TPS,速度惊人 — gajesh · 2026-08-23