OrcaDub 发布语音到语音视频配音模型,MOS 达 4.83
qinzytech · x · 2026-07-28
OrcaDub 1.0 主打端到端语音配音与多语种本地化
OrcaDub 发布了一款面向生产环境的 speech-to-speech 视频配音模型,强调在本地化时尽量保留原视频的 音色、情绪、语气节奏、时间对齐和口型同步。
主要指标
- MOS 4.83/5
- 说话人相似度 96.8%
- COMET 92.7
- WER 3.1%
- 说话人归因 98.5%
功能点
- 语音到语音的端到端配音
- 情绪与韵律保留
- 支持习语感知的本地化
- 支持歌词/歌曲翻译
- 逐词强制对齐
- 背景音乐保留
- 提供可免费试用的 Web Studio 便于后期编辑
- 提供 OpenAI 兼容 API
服务已上线,按量计费为 每分钟 0.60 美元,并提供 10 分钟免费额度。
「多模态」频道最新
- 用户给 Opus 5.5 三小时预算,模型自主拍出九龙超现实恐怖短片 — rainbird · 2026-09-23
- AI 生图博主分享高速公路场景 prompt,自晒连续出图效果 — techhalla · 2026-09-23
- Opus 5.5 生成 2000 年代风格火柴人格斗动画 — JasonBotterill · 2026-09-23
- 《平常》:AI 生成九龙城寨题材恐怖短片引发关注 — rainbird · 2026-09-23
- 截图角色配一条提示词即可生成同款角色 — iamaliveix · 2026-09-23
- Google 开源 Noto 3D:2D 贴纸变立体,才发现狗狗只有三条腿 — GoogleDesign · 2026-09-23