HeyGen 把头像行为拆成独立 LoRA 再组合推理
HeyGen · x · 2026-07-25
HeyGen 发布了一项头像控制研究更新:他们不依赖“表情、视线、镜头”都同时标注的共标数据,而是把每种行为分别做成独立 LoRA,用单属性数据单独训练。
推理时再把这些行为组合起来,并用少量真实的重叠样本做短微调,尽量缩小训练与推理之间的差距。
「多模态」频道最新
- Opus 4.1 的艺术创作上头感变成了可转发的 AI 笑点 — liminal_bardo · 2026-07-25
- SuperSplat 引入 WebGPU 与体素碰撞,实现海量点云极速渲染 — willeastcott · 2026-07-25
- HeyGen 演示视频背景移除的三层输出 — HeyGen · 2026-07-25
- Google 说,Agent 行为来自 prompt、评测与反馈闭环 — AI Engineer · 2026-07-25
- 用户实测称 Krea2 连“adherence”都拼不对 — MiddleAgeWeirdoMeep · 2026-07-25
- OcularAudio MCP 让 agent 本地读取 YouTube 字幕和截图 — Carbon-B · 2026-07-25