AutoCAD-Bench 显示 GPT-5.6 Sol 在 CAD 电脑操作任务中领先 46%
gabrielchua · x · 2026-07-24
AutoCAD-Bench 评测显示 GPT-5.6 Sol 在电脑操作式 CAD 任务上领先
DevvMandal 发布了 AutoCAD-Bench,用来测试 AI 模型是否能仅靠 computer-use 完成精确的 AutoCAD 任务。
- 文中称 GPT-5.6 Sol 以 46% 的成绩领跑,能一次性完成不少基础和中阶任务。
- 引用里还展示了模型在 没有 API、没有 MCP 的情况下,直接做完一整张 AutoCAD 图纸的演示。
- 这个结果被视为结构化工程工作流里 computer-use 能力的重要信号。
所属事件:AutoCAD-Bench发布,GPT-5.6 Sol领跑CAD任务(4 条相关)→
「模型」频道最新
- LLM 已能解未解数学题,苦涩教训再度应验 — haider1 · 2026-07-24
- Moonshot 的 Kimi K3 展示开源模型如何借外部算力取胜 — scientificamerican · 2026-07-24
- Kimi K3 被指 2.8 万亿参数 MoE,引发模型争议 — pstAsiatech · 2026-07-24
- Claude 反复说累了,用户吐槽这套人设太过头 — econoar · 2026-07-24
- Kimi k3 很强,但跑分不能证明真实能力 — FuSheng_0306 · 2026-07-24
- Apertus 1.5 公开上线,开始支持图像能力 — valentina__py · 2026-07-24