MIT 框架教视觉语言模型生成更准确的 CAD 程序
bravo_abad · x · 2026-07-28
MIT 让 2D 草图转 CAD 更准、更省算力
MIT 和合作方提出了一个名为 GIFT 的框架,用来提升视觉-语言生成模型把 2D 设计转换成 CAD 程序 的能力,目标是用于 3D 原型设计与仿真测试。
- 这个系统会让模型先尝试生成,再把失败案例和成功方案一起整理成新训练数据。
- 通过“用模型自己的错误教模型”,它能更有针对性地修正具体失误,处理更难的设计问题。
- MIT 表示,这种方法生成的 CAD 代码比现有做法更准确、更可用,而且只需要一小部分计算量。
- 可能带来的变化包括:更快的原型开发、更低的成本,以及帮助工程师发现原本可能忽略的设计方案。
「多模态」频道最新
- Seedance 2.0 用提示词做出超写实手持健身 vlog — eyishazyer · 2026-07-28
- Vision-OPD 用 6.2K 合成样本提升细粒度视觉理解 — 小红书技术REDtech · 2026-07-28
- RTX 3060 实测:Mage-Flow 比 Krea 2 Turbo 快 13–18 倍但画质落后 — SirMick · 2026-07-28
- “33°C”只是文本,不等于触觉体验 — flowersslop · 2026-07-28
- 一条 Seedance 2.0 提示词复刻 90 年代街机厅 — techhalla · 2026-07-28
- 开发者用 OpenClaw 和 MiniCPM-V 4.6 搭出本地照片助手 — 面壁智能 · 2026-07-28