Suno 推出 Speech 测试版:首个语音与背景音乐一体生成的音频模型

suno · x · 2026-10-02

Suno 官宣 Speech 进入 Beta,官方称这是首个能同时生成人声与配套背景音乐、输出完整连贯音轨的音频模型。用户在 Suno 中输入一段想法、诗歌或自己写的文字,再描述想要的声音风格与音乐风格,即可生成带配乐的口语化音频。

团队在开发中发现了不少玩法:把朋友的消息做成浮夸的戏剧化朗读、给普通语音便签配上史诗级配乐、制作冥想音频、诗歌、打气内容和儿童睡前故事等。Speech 内置于 Suno 应用,过去一个月先在小范围测试,现已向所有用户开放 Beta。

官方也坦承模型还不成熟:英式口音偶尔会「跑偏到澳大利亚」,戏剧性停顿可能过于夸张,后续会持续改进。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →