AMRD:面向端侧设备的轻量级语音情感识别蒸馏方案
Yuqi Li · hf · 2026-07-31
大型自监督模型在语音情感识别(SER)任务上表现优异,但高昂的计算成本限制了其在边缘设备上的部署。本文提出自适应多教师关系蒸馏(AMRD)框架,通过知识蒸馏将大模型压缩为轻量级学生模型。
该方法解决了两个痛点:一是利用单类 SVM 根据批次动态评估教师模型的可靠性并分配权重;二是引入关系蒸馏损失,对齐教师与学生模型间的样本相似度矩阵,从而保留传统逻辑匹配忽略的样本间结构信息。在 IEMOCAP 和 CREMA-D 数据集上,AMRD 在多数设置中优于单教师蒸馏基线,消融实验也证实了两个组件的互补增益。
「研究」频道最新
- 3D胸部CT视觉语言模型用于自动报告生成研究被接收 — maier_ak · 2026-07-31
- Google DeepMind 解散 AlphaFold 团队,研究人员转投 Gemini — emmanuelvivier · 2026-07-31
- Glob3R:基于3D基础模型的全局SfM重建框架 — rsasaki0109 · 2026-07-31
- 港大教授Taku Komura:用消费级设备构建具身智能原生世界模型 — 量子位 · 2026-07-31
- 突破边走边抓瓶颈:CoorDex让49自由度人形机器人协同操作 — 量子位 · 2026-07-31
- 当 AI 智能体成为推荐系统用户,架构该怎么变? — _reachsumit · 2026-07-31