仅用 341 张静帧训练 LoRA:MiniMax H3 视频模型动态能力实测
shootthesound · reddit · 2026-09-19
作者针对「用图像训练会毁掉视频模型动态能力」的旧说法做了对照实验:用 341 张静帧训练的 LoRA 加载到 MiniMax H3 上,与未加载版本用相同 prompt、相同 seed、相同设置做纯 T2V 生成对比。
- 结论:训练后模型的运动/动态表现并未如传闻般崩坏
- LoRA 训练与推理通过开源工具 Fizgig(v6.2.0)完成,仓库在 GitHub 上
- 为想在自有素材上定制视频风格又担心损失动态效果的创作者提供了参考。
「多模态」频道最新
- 用 Seedance 2.5 生成 30 秒史诗法师单挑片,动作分镜全程无断层 — LudovicCreator · 2026-09-19
- Midjourney v8.2 换词创作:废弃温室里的"铜寡妇"蜘蛛 — tisch_eins · 2026-09-19
- 用开源 YuE2 本地生成翻唱歌曲,零数据中心跑通音乐创作 — cocktailpeanut · 2026-09-19
- Runway CEO 感叹:一个人纯用 AI 复现真实故事已成现实 — jnack · 2026-09-19
- Meta 发布 SAM 3.1:一次 API 调用完成检测、分割与视频追踪 — AIatMeta · 2026-09-19
- Runway 视频模型 Ruby 支持透明通道,一步转换 HDR 不丢 alpha — runwayml · 2026-09-19