北大团队提出原子动作框架,让AI学会结构化编舞
机器之心 · wechat · 2026-08-05
北京大学团队的一项最新研究被 ECCV 2026 接收。该工作聚焦音乐驱动的舞蹈生成,提出以“原子动作”作为舞蹈的基本单元,建立了具备明确语义和结构的舞蹈表示方法。
现有主流方法多采用端到端序列生成,直接预测人体姿态,导致生成的舞蹈缺乏整体一致性且难以编辑。为此,研究团队设计了两阶段框架:先进行高层“动作规划”,预测动作种类与位置生成“舞蹈乐谱”;再进行“舞蹈补全”,利用扩散模型生成自然衔接。这种模拟人类编舞过程的方法,显著提升了生成舞蹈的真实性、节奏与结构一致性,并支持高度可编辑性。
「多模态」频道最新
- Suno 音乐配 Hailuo 视频:AI 单人厂牌工作流实测 — techhalla · 2026-08-05
- Hermes Desktop 结合 ComfyUI 实战:让 AI 自动修复工作流报错 — Birdinhandandbush · 2026-08-05
- AI 输出模仿人类手写笔记,支持涂抹与图表流式渲染 — op7418 · 2026-08-05
- ComfyUI 实用脚本推荐:任务完成自动声音提醒 — RPGstarDestroyer · 2026-08-05
- 清华提出 STAMPlus:一次推理解决多模态分割三难困境 — Tsinghua · 2026-08-05
- V2N 系统:基于视觉的多任务钢琴全量音符转录 — PianoVAM · 2026-08-05