把建筑图纸 PDF 喂给 SOTA 模型生成 3D 漫游:有进步但仍不准确
mobileraj · x · 2026-09-23
受 Simon Willison「鹈鹕骑自行车」测试启发的模型能力实测:作者给每个 SOTA 模型一份建筑蓝图 PDF,要求生成可走进去漫游的 3D 渲染。结论是能力在改善但仍有明显差距——早期 SOTA 模型会直接超时,现在通常能完成任务,但生成的平面图严重失真,且经常违反物理规律。这个测试可复现,是观察模型空间理解能力演进的简易标尺。
「模型」频道最新
- 代码评测多是夹带私货的糊分数,开发者呼吁按领域细分 benchmark — almmaasoglu · 2026-09-23
- 信封上画草图,Grok 4.7 几分钟内做出可玩解谜游戏 Lightweave — luismbat · 2026-09-23
- Databricks 上线三款前沿模型,GPT-6 Sol/Luna 与 Opus 5.5 进 Unity Gateway — matei_zaharia · 2026-09-23
- Grok 4.7 跑分接近 Opus 5.5,价格仅 1/2 到 1/7 — elonmusk · 2026-09-23
- 用户实测称 Opus 5.5 在真实工作场景仍落后 — BLUECOW009 · 2026-09-23
- 内部人士初体验疑似 Opus 5.5:能力强但「不像 Opus 的感觉」 — repligate · 2026-09-23