PRISM:音频模型无训练适应新方法
Ashish Anand Shukla · hf · 2026-08-18
PRISM 是一种快速的、无需训练的测试时适应方法,旨在解决音频文本模型中的严重声学偏移问题。该方法利用冻结的文本原型和几何校正来反转低秩仿射噪声失真,无需重新训练即可提升模型性能。
「研究」频道最新
- Google 扫描物体数据集上架 HF:1030 个家用物品 3D 扫描 — BlackHC · 2026-08-18
- 生成式搜索正在「吃掉」网络:论文建模语料库侵蚀与消亡阈值 — IgorCarron · 2026-08-18
- 网易发布 Confucius4-TTS,支持 14 语言跨语种零样本克隆 — _akhaliq · 2026-08-18
- 浙大开源 PhyEdit:单图沿三维轨迹搬物体,盲测偏好率 78% — 新智元 · 2026-08-18
- AI 压缩上下文时悄悄丢弃 83% 用户指令 — The Decoder · 2026-08-18
- 上交大推出 TRACE-Bench 多参考图像生成基准 — SJTU · 2026-08-18