重度用户实测 Astra(GPT-6):智力更强但「不懂意图」,或弃用回退 Sol 5.6
ZenenoDev · reddit · 2026-09-05
一位长期重度使用 Claude 和 Codex 的开发者分享了 Astra(GPT-6)的首日实测,结论是「高智力、低直觉」。
核心观察:
- 作者主营复杂的编排与工作流系统,极度依赖模型理解现有架构、约束和实现意图。
- Astra 确实展现了新能力:有些解法聪明到其他模型没尝试过。
- 但在数小时内、不同会话中出现了约 4 次意图理解偏差:给定已存在的浏览器预览系统和文档后,仍提出引入新浏览器基础设施和 Cloudflare 集成的过度方案,且未解释为何现有系统不够用。
- 更糟的是,Astra 会在方向未达成一致前就自行选定方案开始实现;对比之下 Codex 的 Sol 5.6 会先读文档、解释计划、留出澄清空间。
结论: 编码与解题能力的提升伴随着协作体验的退化,频繁纠偏的额外成本让作者考虑换回 Sol——这对偏好新模型的他来说是罕见转变。作者认为「理解约束、选合适规模的方案、沟通计划」本身就是技术能力的一部分,希望 OpenAI 关注这些方面。
所属事件:OpenAI 发布 GPT-6「Astra」,宣告 AGI 时代引发争议与实测热潮(19 条相关)→
「编程与Agent」频道最新
- 用苹果免费模型在 iOS 上搭一个本地 ChatGPT:文本+语音全离线 — amos_gyamfi · 2026-09-06
- MCP 推荐榜单都回避的核心问题:你到底给了 agent 多大破坏半径 — aineemaniee · 2026-09-06
- LiveAgent:本地优先 AI agent 桌面客户端,多模型加本地工具执行 — solyarisoftware · 2026-09-06
- 博主爆料:Cognition 或将很快发布新编程模型 — realsohamparekh · 2026-09-06
- Reddit 用户自建免费创意工作室 AskSary,内置游戏引擎与 GPT 联机对战 — Beneficial-Cow-7408 · 2026-09-06
- 日本网友分工哲学:有趣的终端活自己干,无聊杂活丢给 Claude — 4310sy · 2026-09-06