实测对比:Astra 视觉与电脑操作碾压,但超长上下文成明显短板
firstadopter · x · 2026-09-06
博主 rishdotblog 对 Astra 与 Fable、Sol 做了大量 head-to-head 对比,firstadopter 称这是「台阶式跃升」,并引用结论:
- 前端任务:Astra 轻松胜出
- 视觉/Computer Use:Astra 表现极强,「没有其他模型能接近」
- 长上下文:Astra 明显偏弱,处理超过 10 万 token 的上下文时更容易漏掉关键信息(作者猜测可能是推理 token 更少),复杂任务上作者更倾向用 Sol
- 规划与战略:Astra 敷衍,远逊 Fable,作者不敢用它做可能引入隐蔽 bug 的工作
总体结论:Astra 是视觉与交互场景的跨越式进步,但精细规划与超长上下文场景存在回退。
「模型」频道最新
- Anthropic 联创 Tom Brown:同级前沿模型价格一年降约 20 倍 — victor_explore · 2026-09-06
- 前沿模型研究者:机器人数据入 VLM 后 VLA 与 WAM 界限将消失 — ChongZzZhang · 2026-09-06
- 爆料称某模型 3.8 提前一天已可使用,发布节奏遭圈内质疑 — cgarciae88 · 2026-09-06
- GPT-6 Astra (Max) 登顶 Code Arena:WebDev,1797 分反超 Claude — Polymarket · 2026-09-06
- 第三方实测称 Astra 基准表现仍差,笑点只有一个 — gleech · 2026-09-06
- Astra 电脑操作实测翻车:拖拽编辑器建页失败,但仍是进步 — BLUECOW009 · 2026-09-06