开源视频模型让老玩家回流:参考图直出,LoRA 时代或终结
Peregrine2976 · reddit · 2026-09-03
一位只玩开源权重模型的作者表示,MiniMax H3 终于把他拉回了视频生成:此前 Wan 2.2 的质量与一致性不达标,好用的工具又都是闭源付费产品。
- 它是多模态模型带视觉理解,可直接喂参考图/角色设定图,让模型理解新概念的反馈循环比训练 LoRA 短得多
- 作者判断角色/服装/场景类 LoRA 不会立刻过时,但需求会大幅减少
- 作者附了完整工作流(Pastebin)和所用参考设定图(Imgur),可照着复现
作者的开源立场:他要能被拆解、修改、不被任何平台绑架的技术,类似用 Linux 和 Firefox 的理由。
「多模态」频道最新
- 用户让 Tavus 数字人自己造一个搭档,过程一路失控成名场面 — Kyrannio · 2026-09-03
- Photoshop beta 大幅改进发丝抠图,用户惊呼可以重修旧照了 — rufusd · 2026-09-03
- Grok 视频生成支持最多 14 个参考素材,可用 @ 标注引用 — aziz4ai · 2026-09-03
- Meta 开设 HF 官方 org,Muse Glimmer 30B 本地部署下载量超 61 万 — MaziyarPanahi · 2026-09-03
- 老帖翻出:StyleGAN3 意外生成《蒙娜丽莎》风趣图 — Merzmensch · 2026-09-03
- Meta 发布 Muse Spark 1.3,维京手办实测对比 1.2 — alexandr_wang · 2026-09-03