LLM空间推理能力受限:能建好看城堡但内部结构不通
Angaisb_ · x · 2026-08-10
作者指出,当前大语言模型(LLM)在《我的世界》等沙盒游戏中已能生成外观壮观的建筑,但由于缺乏空间推理能力,这些建筑往往内部空洞、走廊不通。
尽管 VoxelBench 等测试显示模型生成的视觉效果越来越好,但功能性极差。作者在测试中发现,GPT-5.5、GPT-5.6 和 Fable 5 等模型在建造房屋时都会犯类似的逻辑错误,这表明这不仅是视觉理解问题,更是纯粹的逻辑能力缺陷。
「模型」频道最新
- 曝 OpenAI 拆分 Doug 与 Astra 双线,Meta 发布低功耗 Agent 模型 — vista8 · 2026-08-10
- 曝 Meta 将发 30B 新开源模型,架构融合 Gemma 4 与视觉 — ivan_bezdomny · 2026-08-10
- Google 发布 Gemini Omni Flash:支持多模态生成与运镜控制 — shlomifruchter · 2026-08-10
- 单卡跑满 256k 上下文:实测 Muse Glimmer 30B 本地部署显存与性能 — coder543 · 2026-08-10
- 扎克伯格预告:即将开源最新模型 Muse Spark 1.2 — rohanpaul_ai · 2026-08-10
- DeepSeek V4 Flash 横评多款 Agent 框架,Pi Agent 性价比登顶 — TheZachMueller · 2026-08-10