LoT:按布局分配精细 token,图像生成最高提速 4.6 倍
GordonWetzstein · x · 2026-10-07
斯坦福 Gordon Wetzstein 组(一作 George Naka)提出 LoT(Layout of Tokens):生成过程自适应布局——在 prompt 需要细节的地方分配精细 token,加速程度由布局的 token 预算决定。示例中 LoT 用 6,632 个 token(全分辨率为 14,336)实现 2.5 倍生成加速;细节更集中时最高可达 4.6 倍。已放出论文与项目页。
所属事件:斯坦福提出 LoT 扩散模型,按需分配 token 最高提速 4.6 倍(4 条相关)→
「多模态」频道最新
- 手机实时操控 3D 场景:音频驱动程序化装置 demo 迭代 — DimitriDeJonghe · 2026-10-07
- 开发者用 HeyGen Video 1 做互动叙事 App:用户日均停留超 60 分钟 — HeyGen · 2026-10-07
- AI 制作后末日剧集《THE FINISHED WORLD》放出正式预告片 — No-Party-2924 · 2026-10-07
- Jordi Pons 推出 AI 互动音乐游戏「一只鸡死了」 — jordiponsdotme · 2026-10-07
- LichtFeld 稠密化插件大提速:85.5 秒降至 16.7 秒 — janusch_patas · 2026-10-07
- 保持角色一致性画四格漫画:角色卡+锁定外观+两个典型翻车 — oooooooooooopsi · 2026-10-07