Every 实测:GPT-6 Astra 强在写作,长任务仍输给 Anthropic Fable
every · x · 2026-10-03
- Every 发布新一轮 Vibe Check 评测,主角是 OpenAI 新模型 GPT-6 Astra 与 Anthropic 的 Fable。
- 写作与软件操作:Astra 仅凭一个 prompt 写出的评测初稿,连 CEO Dan Shipper 都误认为是人类员工写的;在写作、操控软件、视觉设计上都有明显升级。
- 长任务短板:Dan Shipper 认为 Astra 容易误解 prompt 意图、爱给要构建的东西加过多“花哨功能”,在大型委派任务上不如 Fable 可靠。
- 实例对比:高级编辑 Jack Cheng 让两者把他手写日记数字化成应用,结果清晰体现了各自强弱。
- 结论:GPT-6 Astra 是大幅升级但有“坏习惯”,Anthropic Fable 在产品构建直觉上仍占优。
所属事件:Every 实测 GPT-6 Astra:写作惊艳但长任务不敌 Anthropic Fable(2 条相关)→
「编程与Agent」频道最新
- 把 Slack 频道变成 Agent 任务池:每条 bug 自动建 draft PR — gabrielchua · 2026-10-03
- Meta Muse 下载量破 500 万,AI 反馈循环或成护城河 — RihardJarc · 2026-10-03
- Context.dev 推面向 AI Agent 的网页抓取 API,主打「极致主动性」文化 — DanielLockyer · 2026-10-03
- 从「MCP 是上下文税」到拥抱 MCP:Arize 发布托管 MCP 服务器 — aparnadhinak · 2026-10-03
- 实测 Muse agent:自主比价购物、订召回维修、挂闲鱼卖货 — IanAndrewsDC · 2026-10-03
- AI 能写 CUDA 内核了,内核工程师转向验证与硬件专长 — anneouyang · 2026-10-03