Astra 从低算力到满配解决率几乎不变,RL 扩展故事遭数据打脸
zainhas · x · 2026-09-05
zainhas 展示的 Astra solve rate density 热力图显示,从低推理预算拉到最高,解决率密度几乎没有变化。他反驳 teortaxesTex 的说法——后者认为「模型对尚未饱和的任务太聪明,给满算力反而会跑偏」,并称该 base 上的 RL 还没做完。
zainhas 指出:如果这种解释成立,热力图右侧至少应出现一些「灵光一现」的高分解,但数据里完全没有,并感叹「这模型太怪了」。
「模型」频道最新
- 网友推测 Google Astra 的能力跃升主要来自视觉 — dumquestions · 2026-09-05
- 20美元/200美元档最具性价比 AI 订阅榜单更新 — popiazaza · 2026-09-05
- antirez 盛赞 Astra:RLVR 规模化的大模型让软件开发跃升 — antirez · 2026-09-05
- 重度用户力挺 Astra:直觉智能碾压同价的 Fable 5.1 — DynaBeast · 2026-09-05
- 问 Fable 5.1 生物安全论文被拒:网友吐槽遭遇「Opus 式拦截」 — nathanbenaich · 2026-09-05
- 同一道电脑检查题,Claude 与 GPT-6 Astra 给出相反答案 — Jardani_xx · 2026-09-05