Every 实测 GPT-6 Astra:最强写作模型,但顶尖端仍不敌 Fable
danshipper · x · 2026-09-04
OpenAI 称 GPT-6 Astra「可能是 AGI」,Every 团队在编码、写作与知识工作场景深度测试后给出评估:
- 写作:作者认为是用过最好的写作模型——快、几乎不出垃圾内容、易于引导,甚至一次性生成了这篇 vibe check 的初稿。
- 计算机使用:表现惊人,可连续数小时操作复杂应用完成工作,甚至剪出了 Fable 5.1 vibe check 视频的初版。
- 总体:相较 5.6-Sol 是大幅升级,但一些令人恼火的习惯使其顶尖端表现仍不及 Fable。
作者对「OpenAI 说它可能是 AGI」的说法持保留态度,整体是一次信息量较高的第一方实测。
所属事件:Every 深测 GPT-6 Astra:写作最强但顶尖端仍不敌 Fable(14 条相关)→
「模型」频道最新
- GPT-6 Astra 系统卡披露:可控自身 CoT 达 60.9%,可逃避监控 — rohanpaul_ai · 2026-09-04
- Greenblatt 警告:GPT-6 Astra 心算竞赛数学,CoT 监控或将失效 — RyanGreenblatt · 2026-09-04
- OpenAI 发布 GPT-6 Astra:ARC-AGI-3 得 99.9%,主打电脑操作 — mervenoyann · 2026-09-04
- Grok 盘点 OpenAI 迭代节奏:Sol 到 Astra 仅隔 2 个月 — msg · 2026-09-04
- GPT-6 Astra 上线 Microsoft Foundry,定位工作场景前沿模型 — DanWahlin · 2026-09-04
- 「Opus 3 的魔力来自它的身体感」:AI 圈津津乐道的模型人格观察 — repligate · 2026-09-04