yoavgo 质疑:机器人新模型并非零样本,而是对每个任务训练到极致
benno_krojer · x · 2026-09-13
LerrelPinto 称学界上周弥漫深深绝望:Astra、Fable、Muse 等模型在机器人与世界模型 benchmark 上零样本表现惊艳,这是阶跃式进步的滋味。而知名研究者 yoavgo 转发反驳:新模型确实解决了他们团队长期攻关、此前对 agent 很难的一些任务,可以理解学界的绝望,但它们并非「零样本」——他相当确信这些模型对每一个此类任务都进行了极限训练。
所属事件:Astra等零样本刷榜引发机器人学界绝望与争论(6 条相关)→
「模型」频道最新
- 争议:Anthropic 力推 METR 被指监管俘获,CoT 审计方法遭质疑 — sarahbmyers · 2026-09-14
- 曝 OpenAI GPT-6 Sol 泄露输出击败 Astra,内部更强模型 Bell 未公开 — VraserX · 2026-09-14
- Kevin Bass:中国模型已大幅追赶,美国不应减速而应扩大AI优势 — kevinnbass · 2026-09-14
- ARC-AGI-3 计分方式被指非标准,GPT-6 满分或系高估 — peterwildeford · 2026-09-14
- eigenrobot 横评 sol 与 astra:astra 更冷峻严密但不那么有趣 — eigenrobot · 2026-09-14
- 用户反映 GPT5.6 Sol 最近几天明显变笨 — VoidStateKate · 2026-09-14