AutoCAD-Bench发布,精准评测AI模型执行CAD任务能力
开发团队正式推出AutoCAD-Bench基准测试,专门用于评估AI模型能否仅通过computer-use(计算机视觉与操作控制)完成精细的AutoCAD任务。在首期评测结果中,GPT 5.6 sol以46%的得分领跑。该测试的发布为衡量大模型在复杂专业软件环境中的实际操作能力提供了全新标准。
2026-07-24 ~ 2026-07-24 · 3 条相关
- AutoCAD-Bench 测试精确 CAD 任务,GPT 5.6 sol 以 46% 领跑 — DevvMandal · 2026-07-24
- 回复仅重复了 AutoCAD-Bench 的发布和得分图 — DevvMandal · 2026-07-24
另有 1 条近重复转述:DevvMandal