OrcaDub 发布语音到语音视频配音模型,MOS 达 4.83
qinzytech · x · 2026-07-28
OrcaDub 1.0 主打端到端语音配音与多语种本地化
OrcaDub 发布了一款面向生产环境的 speech-to-speech 视频配音模型,强调在本地化时尽量保留原视频的 音色、情绪、语气节奏、时间对齐和口型同步。
主要指标
- MOS 4.83/5
- 说话人相似度 96.8%
- COMET 92.7
- WER 3.1%
- 说话人归因 98.5%
功能点
- 语音到语音的端到端配音
- 情绪与韵律保留
- 支持习语感知的本地化
- 支持歌词/歌曲翻译
- 逐词强制对齐
- 背景音乐保留
- 提供可免费试用的 Web Studio 便于后期编辑
- 提供 OpenAI 兼容 API
服务已上线,按量计费为 每分钟 0.60 美元,并提供 10 分钟免费额度。
「多模态」频道最新
- Krea2 上的 LoKr 测试和 LoRA 很像 — Beautiful_Egg6188 · 2026-07-28
- Kinetic Abyss 展示 Stable Audio 3 和 LTX 2.3 制作的 2D 动画 — Tadeo111 · 2026-07-28
- 如何把参考照片做成逼真的厚涂油画工作流 — Suspicious-Koala-570 · 2026-07-28
- Midjourney 风格工作流:用 GPT 拆解参考图,再筛百张候选 — beechinour · 2026-07-28
- Krea2 细节增强 LoRA:一键消除 AI 图像糊感与雾感 — linoy_tsaban · 2026-07-28
- 用 Runway 与 Suno 制作千禧年流行朋克风 MV — notiansans · 2026-07-28