15 秒音频几秒克隆声音,Cartesia Sonic 3.6 支持 44 种语言
omarsar0 · x · 2026-10-03
Elvis Saravia(omarsar0) 实测了 Cartesia 最新语音模型 Sonic 3.6:用一段约 15 秒的音频在 playground 中克隆自己的声音,几秒内即完成。
克隆的声音随后用他不会说的日语流利朗读了一句话,效果自然。Sonic 3.6 支持 44 种语言,他建议可用这类技术让内容以多语言触达更多受众。
「多模态」频道最新
- Runway 图生图把角色变成「另类深夜秀」主持人,作者称值得多做 — c_valenzuelab · 2026-10-04
- 免疫学家用 Claude 生成全代码免疫学史短片,帧帧音符皆代码 — DeryaTR_ · 2026-10-04
- Seedance 2.5 细节碾压,用户催更 Minimax H3 承诺的 2K 更新 — Cequejedisestvrai · 2026-10-04
- 全本地生成赛博朋克风 MV:Yue2 配乐 + LTX2.5 视频 — RavioliMeatBall · 2026-10-04
- SeedVR2 视频超分更新:BF16 转换再省 3GB 显存,照顾 6GB 用户 — Zestyclose_Bake3680 · 2026-10-04
- Studios 接入 MCP:在 ChatGPT 和 Claude 里直接生成图像视频 — TheMoonMidas · 2026-10-04