Reddit 实测:GPT-Astra 解 Mensa 智力题两试通过,Sol 两次皆败
kaljakin · reddit · 2026-09-07
Reddit 用户 kaljakin 用 Mensa 风格谜题对比测试了两款模型:Astra Extra High 首次尝试失败后,在不到一分钟内第二次答对;而 Sol High(5.6) 两次尝试(每次各思考约两分钟)均告失败。作者认为 Astra 整体强于 Sol,但仍有失手的时候。
他还计划用 TrackingAI.org 的 Mensa 测试观察 Astra 的官方智商分数,并表示自己的测试集仍未被模型刷满。
「模型」频道最新
- 让 AI 随机选 1-30 的数,多数模型都答 17 — ohnag_eryeah · 2026-09-07
- Polymarket 预测市场押注 Anthropic 本月发布下一代 Claude Opus,概率 82% — Polymarket · 2026-09-07
- GPT-6 Astra 实测:推理更强却耗更少 token,效率成最大亮点 — haider1 · 2026-09-07
- 网友晒 Astra 6 xhigh 自称「AGI」的截图 — viksit · 2026-09-07
- OpenAI 员工预测 Blender x Astra 到 2027 年中大幅进步 — Distinct-Question-16 · 2026-09-07
- GPT-6 Astra 跑通 71492 原子分子模拟,可拆解视角观察膜蛋白 — DeryaTR_ · 2026-09-07