Suno 推出 Speech 测试版:首个语音与背景音乐一体生成的音频模型
suno · x · 2026-10-02
Suno 官宣 Speech 进入 Beta,官方称这是首个能同时生成人声与配套背景音乐、输出完整连贯音轨的音频模型。用户在 Suno 中输入一段想法、诗歌或自己写的文字,再描述想要的声音风格与音乐风格,即可生成带配乐的口语化音频。
团队在开发中发现了不少玩法:把朋友的消息做成浮夸的戏剧化朗读、给普通语音便签配上史诗级配乐、制作冥想音频、诗歌、打气内容和儿童睡前故事等。Speech 内置于 Suno 应用,过去一个月先在小范围测试,现已向所有用户开放 Beta。
官方也坦承模型还不成熟:英式口音偶尔会「跑偏到澳大利亚」,戏剧性停顿可能过于夸张,后续会持续改进。
「多模态」频道最新
- Suno 官方确认:语音与背景音乐可单次生成,音乐随人声动态起伏 — suno · 2026-10-02
- Qwen-Image-2.1 登顶开源图像榜,文生图与图像编辑总分第18 — ArtificialAnlys · 2026-10-02
- 扩散模型研究者 Stefan Webb 加盟 Inception 任首位 DevRel 工程师 — volokuleshov · 2026-10-02
- stillwet:AI 在模拟油画工作室逐笔作画,多幅临摹 Friedrich — ctjlewis · 2026-10-02
- Ben Affleck 自建数据微调视频模型,AI 公司获 Netflix 5.87 亿美元收购 — rohanpaul_ai · 2026-10-02
- ComfyUI 新增 LLM 提示词增强节点,支持本地与 API 双模式 — Constant-Tower9662 · 2026-10-02