CurveCodec 2 骨骼动画压缩仅 ACL 22-37% 体积,单核 CPU 解码
HKU-CGVU · hf · 2026-10-06
骨骼动画把每帧每个关节的变换都存下来,但大部分信息由身体结构隐含。HKU 团队通过测量指出冗余主要在两处:对每条量化曲线用自己的历史做预测(最大节省),以及经层级闭环选择不编码哪些采样点。而网络真正该接管的是编码器剩余残差的分布,不是插值——实验显示百万级样本上的最近邻 oracle 插值效果不比线性插值好。
CurveCodec 2 把每条子轨道编码为 log 映射中的曲线,闭环量化、按率失真选取关键帧,残差用小型学习熵模型编码,整数推理跨平台比特精确。对 33 个数据集的 4,472 条留出测试片段:
- 最坏情况契约(逐关节不超 ACL 最坏误差)下,0.01cm 精度只需 ACL 0.37 倍字节
- 平均误差契约下 0.1cm 精度只需 0.22 倍
- 单 CPU 核解码,无需重训练即可迁移到训练中未见的物种(骨架无关)。
「研究」频道最新
- CellType 发布 CT-Perturb:语言模型预测细胞对药物与基因敲除的反应 — david_van_dijk · 2026-10-06
- 骨骼肌肉形态空间漫游:会变形的骨架研究演示 — zzznah · 2026-10-06
- 表格基础模型怎么推理?nanoTabPFN 架构拆解笔记 — pandeyparul · 2026-10-06
- WaveFront 解码让循环语言模型提速最高 4.81 倍,无需训练 — pmttyji · 2026-10-06
- HLA-WM:免训练混合注意力,长视频世界模型记忆省12倍 — Monash · 2026-10-06
- LiFT 循环Transformer:参数省60%,FID 反降3.34点 — VISLab-Amsterdam · 2026-10-06