开发者实测:Astra 综合能力大幅领先 Fable 5.1,computer use 拉开差距
soumitrashukla9 · x · 2026-09-06
开发者 soumitrashukla9 表示,与其纠结刷榜(benchmarkmaxxing),不如在同类任务上直接对比 Astra 与 Fable 5.1:Astra 明显领先一个档次,尤其是 computer use(计算机操作)能力,在他看来足以让 Astra 处于全新级别。帖子提供了对两大模型实际任务表现的第三方一手观察。
所属事件:实测显示 Astra 视觉与电脑操作能力领先,超长上下文是短板(2 条相关)→
「模型」频道最新
- Similarweb:ChatGPT 月活破 10.6 亿,连续 4 个月创新高 — FinanceYF5 · 2026-09-11
- PuzzleMask 用普通英文绕过全部 4 个 LLM 门卫模型 — TechNadu · 2026-09-11
- 曝 OpenAI Codex 或于本周末再发额度重置,Codex 负责人暗指常有 — umesh_ai · 2026-09-11
- 曝 OpenAI 用 Navier-Stokes 模型攻黎曼猜想与 P vs NP — 141_1337 · 2026-09-11
- 实测发现 OpenRouter 不稳定支持 Meta Muse effort 档位,欧盟付费也受阻 — PawelHuryn · 2026-09-11
- 用户实测:Codex 单轮烧掉 4700 积分,$200 额度 20 分钟未完成任务 — RileyRalmuto · 2026-09-11