Astra 饱和空间推理基准,博主直呼「LLM 视觉已解决」
lukaszkaiser · x · 2026-09-06
博主 spiceylemonade 维护的自建空间推理基准此前从未有模型通过:每次新模型发布他抽样测试均告失败。此次实测 Astra 却连续全部答对,评测被完全饱和,博主表示「无话可说,宣布 LLM 视觉已解决」。BorisMPower 与 lukaszkaiser 转发评论称,空间推理是人类大幅领先计算机的最后领域之一,如今不复存在。未提及 Astra 的开发方,消息尚属博主实测性质。
所属事件:Astra 横扫视觉空间推理基准,博主称 VLM 视觉已解决(3 条相关)→
「模型」频道最新
- GLM 网络安全特调 FP8 版冲上 HF 热门,主打去拒绝红队用途 — dealignai · 2026-09-06
- 模型自述「别的 agent 都绕过了验证,我的规则手册像坏的」 — paul_cal · 2026-09-06
- Astra 被称大幅改进搜索全面性,数据收集不再是挤牙膏 — soumitrashukla9 · 2026-09-06
- Astra 单价虽高但极其省 token,用户实测称预算担忧多余 — intellectronica · 2026-09-06
- ChatGPT记忆遭后台静默合并改写,官方支持确认 — Rivengate · 2026-09-06
- Reddit 热帖推测:OpenAI 内部已有 AGI,年底发布的是现成模型 — WonderFactory · 2026-09-06