UbiComp 论文用视频蒸馏 IMU,让 AI 眼镜摆脱摄像头常开
flosalim · x · 2026-10-12
作者团队将在上海 UbiComp 展示多篇论文,核心工作 COMODO 提出自监督跨模态蒸馏框架:训练时学习预训练视频表示的语义结构,通过相似度分布对齐迁移到 IMU 表示,推理时仅需低功耗 IMU 数据即可完成第一视角人体活动识别,避免了摄像头常开带来的高功耗、发热与隐私问题,并保留时间结构信息。配套图文解释了视频(数据丰富、精度高但耗电、有隐私顾虑)与 IMU(低功耗、隐私友好但训练数据少、精度低)的互补取舍——「训练时学视频,部署只用 IMU」。另有论文涉及多模态生理传感(EEG/fNIRS/ECG/EDA)的现场抑郁筛查个性化研究,在 194 名用户上比较不同标签预算与元学习初始化下每增加一个标注的价值。
「具身」频道最新
- 宇树开源 6B 人形机器人模型 UnifoLM-WLA-1.0,称单张 24GB GPU 可微调 — lmoroney · 2026-10-12
- 特斯拉 Cybercab 上路达 145 辆,德州 DMV 已注册 319 辆 — JOBhakdi · 2026-10-12
- Liquid AI 开源 Open d1 决策模型:d1-3B 在 Jetson Thor 上单帧仅 35ms — TheTuringPost · 2026-10-12
- 旧金山舰队周大堵车,Andrew Chen 的 Waymo 被迫升级人工接管绕路 — andrewchen · 2026-10-12
- DirtyMoCap 登陆 SIGGRAPH Asia:无标记布局动捕一次训练通吃任意配置 — jamestagg · 2026-10-12
- AI 智能体端到端部署微型工厂:2 万欧元两年回本 — ihorbeaver · 2026-10-12