GPT-6 Astra 实测:跑分平平但实用体验获用户辩护
围绕 OpenAI 新发布的 GPT-6 Astra,社区评价呈现两极:有用户称其在基准对比中表现接近 Fable,在 computer use 与科学类任务上更强,但发布前被过度炒作;也有用户为其辩护,认为它像 GPT-5 一样发布初期表现粗糙、个别 benchmark 成绩可疑,实际使用体验好于跑分,并吐槽部分评测者尚未真正上手。
2026-09-04 ~ 2026-09-04 · 2 条相关
- GPT-6 Astra 被评「跑分平平但好用」,社区吐槽评测者还没用上 — ns123abc · 2026-09-04
- GPT-6 Astra 实测: computer use 与科学任务强,但此前被过度炒作 — davidthesong · 2026-09-04