曝三大前沿 AI 实验室 CAD 基准评分全错,误差最高达 90%
hudzah · x · 2026-10-06
yushg 发帖称,他们发现排名前三的前沿 AI 实验室都在错误地评定 CAD 基准成绩,分数偏差最高达 90%。团队随后研究了一个看似简单的问题:如何判断 AI 生成的零件或装配体是否正确,并据此推出了改进版的验证器 FrontierCAD 来修复评分方法。
「研究」频道最新
- PerturBot 用扰动训练打破视觉-语言-动作模型的捷径依赖 — Mingyu Liu · 2026-10-06
- TextReg 治理提示词过拟合,TextGrad 之上最高提升 11.8% — GeorgiaTech · 2026-10-06
- SourceLearn 让智能体沉淀源级能力,15 项评测 13 项第一 — GeorgiaTech · 2026-10-06
- 用表示空间 MMD 后训练扩散语言模型,16B 模型解码更并行 — yresearch · 2026-10-06
- Attention Relay 免训练迁移 LLM 指令遵循能力给文本嵌入模型 — _reachsumit · 2026-10-06
- PSA 搜索代理写程序筛选候选,两基准成功率提升 4-7.6 个百分点 — _reachsumit · 2026-10-06