AutoCAD-Bench发布,GPT-5.6 Sol领跑CAD任务

DevvMandal团队发布了AutoCAD-Bench评测基准,专门用于测试AI模型能否仅依靠computer-use(电脑操作)方式完成精细的AutoCAD任务。在最新评测中,GPT 5.6 sol以46%的得分在此类精确CAD电脑操作任务中名列前茅。该基准的出现为衡量AI在复杂工程软件中的实际操作能力提供了新标准。

2026-07-24 ~ 2026-07-24 · 4 条相关

另有 2 条近重复转述:DevvMandal · gabrielchua