拆帧+分镜复刻法:用 MiniMax H3 精确还原视频四步工作流
Negative-Whereas3307 · reddit · 2026-09-18
作者演示用 MiniMax H3 复刻一段 talking-head 视频(左边原图、右边复刻),并指出对这类素材直接说「做个类似的」会留下大量未定义项:机位、画面内容、哪些部分要一致。他给出的四步工作流(源自 Hypit,也可手动执行):
- 提取参考帧:挑出表情、姿态或屏幕内容发生变化的帧,作为具体参照。
- 拆解画面要素:把构图、场景、表达方式和叠加元素分开描述——例如本例中的主讲人、排名数字、飞机卡片是场景的独立部分。
- 决定保留项:用拆解结果明确告诉 H3 哪些要复刻、哪些可以变,主讲人的表演与图形元素的指令分开写。
- 双版本对比:逐项对照参考帧,构图对了但缺叠加元素,就是下一次迭代要修的具体问题。
示例复刻保留了 talking-head 形式和编号列表,但画面中没有飞机卡片,说明拆解需考虑此类遗漏。
「多模态」频道最新
- 法国 LightOnOCR-2-1B:单 H100 日处理 49 万页,小 9 倍胜过 OCR 大模型 — thisguyknowsai · 2026-09-18
- 15 秒生成 2D 动画:GPT 图像精灵图 + H3 Max 工作流公开 — techhalla · 2026-09-18
- KITScenes 多模态数据集发布,瞄准 3D 基础模型数据缺口 — abursuc · 2026-09-18
- Qwen-Image-2.1 泄配置:7B DiT 需 56GB 显存跑 4K 分辨率 — bdsqlsz · 2026-09-18
- 开发者造出每天发新歌的 AI 歌手 Will,人格记忆随反馈成长 — kun101 · 2026-09-18
- 球星IP汽车广告成本百万周期两月,Seedance AI 制作压缩到两周 — 机器之心 · 2026-09-18