CVPR2025 论文用相机自运动,让视频无标注学会三维听声辨位

量子位 · wechat · 2026-07-26

来自清华大学和密歇根大学的团队在 CVPR 2025 Highlight 上提出了一种新方法:不用 360 度麦克风阵列,也不用人工标注,直接利用无标注互联网视频学习三维空间音频感知。

核心思路

数据与方法

结果与结论

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →