Every 实测 GPT-6 Astra:首稿可乱真,但习惯有瑕疵
danshipper · x · 2026-09-04
Every 发布对 GPT-6 Astra 与 Anthropic Fable 5.1 的详细评测(Vibe Check)。
- 首发当夜:团队凌晨 3 点得知 Astra 上线,7 点就拿到一篇 3000 字的完整评测初稿——由 Astra 单条提示词生成,格式、标题、配图一应俱全,CEO Dan Shipper 以为是人类写的,撰稿人自嘲「RIP my job」。
- 评测结论:Astra 在写作、操作软件和视觉设计上给人惊喜,是「大升级但有坏习惯」;而 Fable 在「构建产品的直觉」上仍更胜一筹。
- 完整报告含全部 benchmark 与最终判定,另设有两模型的直播对比活动。
所属事件:Every 写作 agent 凌晨 4 小时独立产出 3000 字评测(3 条相关)→
「模型」频道最新
- 网友推测 Google Astra 的能力跃升主要来自视觉 — dumquestions · 2026-09-05
- 20美元/200美元档最具性价比 AI 订阅榜单更新 — popiazaza · 2026-09-05
- antirez 盛赞 Astra:RLVR 规模化的大模型让软件开发跃升 — antirez · 2026-09-05
- 重度用户力挺 Astra:直觉智能碾压同价的 Fable 5.1 — DynaBeast · 2026-09-05
- 问 Fable 5.1 生物安全论文被拒:网友吐槽遭遇「Opus 式拦截」 — nathanbenaich · 2026-09-05
- 同一道电脑检查题,Claude 与 GPT-6 Astra 给出相反答案 — Jardani_xx · 2026-09-05