Fish Audio 发布 Drama 3 预览版:号称史上最可控 TTS 模型
bdsqlsz · x · 2026-09-24
Fish Audio 推出 Drama 3(preview),称其为「史上最可控的 TTS 模型」。
核心亮点:
- 用自然语言直接描述语气、节奏与角色,无需写音频标签
- 支持句中变声、生成多角色对话场景
- 可只修复单个词而不重录整段
用户可通过评论获取 API key 试用。
「多模态」频道最新
- 照片一键变好莱坞大片感:附完整电影感提示词 — Aiden_Tech_Ai · 2026-09-24
- 别再说「帮我修图」:7 个让 ChatGPT 改图更准的提示词写法 — Aiden_Tech_Ai · 2026-09-24
- 跳过 ComfyUI 直接终端出图:社区里被低估的生成工作流 — JayoTree · 2026-09-24
- 竞速车图生视频 Prompt:一镜到底 15 秒电影级动作戏写法 — umesh_ai · 2026-09-24
- AI UGC 视频生产组合实测:Hypit 拆解策略 + HeyGen 数字人生成 — yihui_indie · 2026-09-24
- Reddit 用户实测 Qwen 2.1 角色 LoKr 训练:多分辨率是关键 — Any_Tea_3499 · 2026-09-24