给 LLM 一支画笔让它们徒手画手,实测各家空间能力
SeesawGullible398 · reddit · 2026-09-03
一位 Reddit 用户设计了一个极简测试:只给大模型一个画笔工具,可通过工具调用设置颜色、硬度、大小,并按 x,y 坐标逐步落笔,然后让各家 LLM 凭空画一只人手。
这个测试把模型的空间想象与工具调用规划能力拆解到最底层——没有图像生成,全靠坐标推理。结果显示模型画手的表现差异明显,成为观察模型空间推理能力的趣味实验。
「模型」频道最新
- 博主称 OpenAI Astra 可自主挖掘并利用安全漏洞 — VraserX · 2026-09-03
- 用户吐槽 GPT-5.6 Max 推理质量骤降:几小时内变笨如 GPT-3.5 — CtrlAltDwayne · 2026-09-03
- 用户实测:Opus 5 全天重度使用,不开子代理并行不愁限额 — 4310sy · 2026-09-03
- 数学家称 Claude 给出 2/3 zeta 零点论证,人类可消化其证明 — Thom_Wolf · 2026-09-03
- 循环深度引发热议:NVIDIA Deja Vu 用千万参数逼近十亿级模型 — ZGojcic · 2026-09-03
- 陈大年入局:27B 本地模型信通院 MCP 测试仅次于 DeepSeek-V4-Pro — 量子位 · 2026-09-03