讨论指出音乐模型从未听过音符全靠文本

在关于 AI 能否「听懂」音乐的讨论中,参与者援引模型自己的回答指出:模型从未听过任何一个音符,训练中没有使用任何能有效捕捉音乐的 tokenizer,其音乐「知识」全部来自文字化的乐评。另有研究者批评当前语音模式下的 AI 对话看似流畅,实则是内容空洞的衍生性表达,并担心当音频能力提升并与核心模型融合后,这种空洞会更难被察觉。

2026-09-17 ~ 2026-09-17 · 3 条相关