Adobe TAC 音频描述模型入选 NeurIPS 2026,联合 LLM 达多项 SOTA

justin_salamon · x · 2026-09-30

Adobe Research 的 TAC(Timestamped Audio Captioning)被 NeurIPS 2026 接收。模型能为任意音频/视听内容生成带时间戳的描述,用 [music]/[sfx]/[speech] 类型标签标注重叠声事件。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →