曝 GPT-6 Astra 空间推理 91.8%,超 80% 人类基线
VraserX · x · 2026-09-06
有博主发帖称 GPT-6 Astra 在 SpatialBench 上取得 91.8% 的成绩,远超 80% 的人类基线,认为模型在空间推理这一人类最后优势领域实现了反超,并称“这是一条被越过的线”。该说法来自第三方账号,未经 OpenAI 官方证实,Benchmark 真实性存疑,可作未证实爆料看待。
「模型」频道最新
- 多家 API 争相低价内卷 DeepSeek-v4-flash,用户几美元烧出海量 token — MaziyarPanahi · 2026-09-06
- 对话频繁提示长度达上限?刷新页面即可继续 — hi-sci-collab · 2026-09-06
- GPT-6 用 20% 额度 3% 进度做出完整 3D Roguelike 游戏关卡 — op7418 · 2026-09-06
- 开发者实测:Astra 独有自我验证习惯,会主动核对工作结果 — dkundel · 2026-09-06
- 开发者吐槽 Codex 商业版额度:重置受限,一周用量仅剩 60% — cnakazawa · 2026-09-06
- DeepSeek v4 模型被曝限时 7 折,加密渠道称迎新社区用户 — matlabulous · 2026-09-06