OmniChar 发布声音克隆版:10 秒语音样音即可锁定角色声线与口型
ashishsanu · reddit · 2026-10-06
独立开发者在 MiniMax H3 + ComfyUI 工作流上扩展了 .char 可携带角色格式:此前已实现跨视频一致的面部、服装与身体,现在加入一致声音——只需 10–30 秒 mp3/wav 样音,角色即可用克隆声线说话并自带口型同步(口型由 H3 本身提供)。
- 已更新 ComfyUI 节点(nightly 版),GitHub 提供带语音编码 .char、MiniMax H3 语音生成、完整面部/身体/服装三套 workflow
- 局限:英语效果好,非英语可能含糊;样音避免多说话人
- 开源 GPLv3,支持 krea2 等模型与角色微调,社区角色库已上线
所属事件:OmniChar 的 .char 角色格式新增声音一致性(2 条相关)→
「多模态」频道最新
- 8 个 Prompt 直接在 Claude Code 里生成讲解视频,无需剪辑软件 — alex_verem · 2026-10-06
- MetaCanvas 入选 NeurIPS:让 MLLM 直接在潜空间做视觉规划 — mohitban47 · 2026-10-06
- 免费设计利器:Ming Image 0.1在ComfyUI的海报与文字实测 — pixaromadesign · 2026-10-06
- 单词出图:Diaphanous 一词生成轻盈剔透的 Midjourney v8.2 图 — tisch_eins · 2026-10-06
- 《公主与龙》经典故事 AI 重新演绎成视频 — Throwaway350750 · 2026-10-06
- Veda 稀疏注意力 ComfyUI 节点:12GB 显存渲染 5 秒视频快 2.9 倍 — lmoroney · 2026-10-06