Every 实测 GPT-6 Astra:写作最强,但仍不敌 Anthropic Fable 的产品直觉
danshipper · x · 2026-09-04
Every 团队在 GPT-6 Astra 发布后进行了覆盖编程、写作与知识工作的深度实测,结论是相对 5.6-Sol 是大幅升级,但在顶尖层面仍不及 Anthropic 的 Fable。
- 写作:认为是目前最好的写作模型——速度快、几乎无 slop、易于引导。CEO Dan Shipper 看到 Astra 从单个 prompt 生成的初稿时,误以为是人类编辑写的。
- 软件操作与视觉设计:表现令人印象深刻,能实际操作软件并完成设计工作。
- 短板:一些令人恼火的习惯使其在「构建产品」的直觉上仍落后于 Fable 5.1。
- 完整评测含全部 benchmark 结果,Every 还将于 9 月 4 日为付费会员开设 Fable 5.1 与 GPT-6 Astra 的对比实操营。
所属事件:Every 实测 Astra:写作与软件操作大升级,仍不敌 Anthropic Fable(2 条相关)→
「模型」频道最新
- Every 实测 GPT-6 Astra:写作惊艳,但 Anthropic Fable 产品直觉仍更强 — every · 2026-09-04
- GPT-6 Astra 横扫 ARC-AGI-3:成绩从 8% 跃升至 63%,外挂适配器达 98.6% — haider1 · 2026-09-04
- Sam Altman 官宣 GPT-6 Astra:自称全球最强计算机操作与编程模型 — eyishazyer · 2026-09-04
- OpenAI 称 GPT-6 Astra 登顶 FrontierMath Tier 4、ARC-AGI 3 等多项最难基准 — dair_ai · 2026-09-04
- 48 小时内连发五款:GPT-6 Astra、Fable 5.1、Gemini 3.8 Flash 齐至 — dr_cintas · 2026-09-04
- Matthew Berman 力捧 GPT-6 Astra:这是我用过最强的模型 — every · 2026-09-04