SFT 越训越慢?OpenUI 用自我训练把生成 UI 有效性从 13% 提到 71.7%

1glasspaani · reddit · 2026-09-09

OpenUI 团队分享为生成式 UI 微调开源模型的完整过程。他们从 DiffusionGemma 起步,先做 SFT:用大模型生成约 700 个样本训 LoRA,loss 降了但基准反而变差——组件 props 和引用频繁出错;限定单一组件库后结构有效性从 13% 升到 28.8%,但生成时间从 1.6s 涨到 4.3s,去噪步数约翻倍。

随后改用自我训练循环:

结果:结构有效性达 57.1%,生成时间降到 1.9s;中位修复只改一条语句,每轮训练在单张 A100 上仅需 1–2 小时。把配方推广到 27 个组件库后,最终模型 OUI-1 达到 71.7%(结构有效性口径,不保证好看或任务完成)。博客、权重与基准已公开。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →