SeedAudio1.0 统一生成音频场景

智东西 · wechat · 2026-07-20

字节跳动发布了 SeedAudio1.0,这是一个音频创作模型,主打从一段提示词直接生成完整声音场景,包含 对白、音效和环境声。

文章里的实测显示,它已经能做几件比较完整的事:

官方给出的测试数据包括:

文章还强调了两个能力:

结论是,AI 音频正在从“会发声”走向“会创作”。

所属事件:字节发布 SeedAudio 1.0 并开放 API(5 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →