从业者观察:Astra 和 Fable 自主执行仍常漏关键细节
philhchen · x · 2026-09-08
作者 philhchen 评价 Astra 和 Fable 两款模型:虽然令人印象深刻,但他认为其在 post-training(智能体/自主任务)上还不够强——给了自主权后表现出的进步是「错觉」,实际执行中会漏掉太多关键细节。
「模型」频道最新
- Astra 思维链显可调用 Sora,一镜生成画面引关注 — mallow610 · 2026-09-08
- 同为每月 100 美元,Codex 和 Grok 谁更适合重编码工作? — Muted_Standard175 · 2026-09-08
- Astra 登顶 ALE-Bench,作者直呼碾压级领先 — scaling01 · 2026-09-08
- 开发者发现 Qwen3.5 35B-A3B 在 Tinker 与阿里云上采样结果不一致 — philhchen · 2026-09-08
- GPT-6 Astra 机器人任务 95% 得分遭质疑:演示难度被美化 — GaryMarcus · 2026-09-08
- 重度用户实测 Astra 后直言:还不是 AGI,只是更强代码猴 — GaryMarcus · 2026-09-08