AutoCAD-Bench 显示 GPT-5.6 Sol 在 CAD 电脑操作任务中领先 46%
gabrielchua · x · 2026-07-24
AutoCAD-Bench 评测显示 GPT-5.6 Sol 在电脑操作式 CAD 任务上领先
DevvMandal 发布了 AutoCAD-Bench,用来测试 AI 模型是否能仅靠 computer-use 完成精确的 AutoCAD 任务。
- 文中称 GPT-5.6 Sol 以 46% 的成绩领跑,能一次性完成不少基础和中阶任务。
- 引用里还展示了模型在 没有 API、没有 MCP 的情况下,直接做完一整张 AutoCAD 图纸的演示。
- 这个结果被视为结构化工程工作流里 computer-use 能力的重要信号。
所属事件:AutoCAD-Bench发布,GPT-5.6 Sol领跑CAD任务(4 条相关)→
「模型」频道最新
- BullshitBench 榜单更新:GPT-6-Astra 领先历代 OpenAI 模型仍未及 Anthropic — scaling01 · 2026-09-11
- Agent Astra 在 GauntletBench 得 83%,成首个超人类基线的电脑操作 Agent — ducha_aiki · 2026-09-11
- Kimi K2.8 Preview 上线:性能接近 K3、1M 上下文全档开放 — teortaxesTex · 2026-09-11
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用户呼声下 DeepSeek V4 Pro API 宣布继续服务,计费不变 — teortaxesTex · 2026-09-11
- 第三方实测:DeepSeek V4.1 Flash 达 GPT-6 Astra 98% 分,成本仅 1.4% — ayushtweetshere · 2026-09-11