OmniChar .char 格式新增声音:10 秒样本锁定角色脸型衣着与嗓音
ashishsanu · reddit · 2026-10-06
开发者 ashishsanu 在其一致性角色方案 OmniChar 的 .char 便携格式中加入了声音一致性:只需 10-30 秒 mp3/wav 语音样本,即可让角色在多段视频生成中保持同一张脸、同一套衣服、同一身体,并用克隆的嗓音说话,口型同步由 MiniMax H3 自带实现,无需额外叠加。
资源与限制:
- ComfyUI 节点已更新(nightly 版本),配套放出了带语音编码 .char、MiniMax H3 语音生成、完整脸/身/衣工作流 JSON,均开源在 GitHub(Omnichar 仓库 GPLv3,支持 krea2 与角色微调)。
- 提供 prompt 示例与社区角色库 omnichar.org/characters。
- 限制:英语效果最好,非英语可能含糊;语音样本避免混入多个声音。
所属事件:OmniChar 的 .char 角色格式新增声音一致性(2 条相关)→
「多模态」频道最新
- 8 个 Prompt 直接在 Claude Code 里生成讲解视频,无需剪辑软件 — alex_verem · 2026-10-06
- MetaCanvas 入选 NeurIPS:让 MLLM 直接在潜空间做视觉规划 — mohitban47 · 2026-10-06
- 免费设计利器:Ming Image 0.1在ComfyUI的海报与文字实测 — pixaromadesign · 2026-10-06
- 单词出图:Diaphanous 一词生成轻盈剔透的 Midjourney v8.2 图 — tisch_eins · 2026-10-06
- 《公主与龙》经典故事 AI 重新演绎成视频 — Throwaway350750 · 2026-10-06
- Veda 稀疏注意力 ComfyUI 节点:12GB 显存渲染 5 秒视频快 2.9 倍 — lmoroney · 2026-10-06