TOM-GS 用时间不透明度调制让静态 3D 高斯变成可编辑视频
kwangmoo_yi · x · 2026-07-29
这篇论文提出 TOM-GS:一种可编辑视频表示方法,不再依赖复杂的空间形变,而是把动态效果主要交给 时间上的不透明度调制 来建模。
核心做法是:
- 每个 3D Gaussian 都带有可学习的时间均值和尺度;
- 它在不同时间点的透明度会平滑变化,从而实现“淡入/淡出”;
- 几何结构保持静态,配合较稳健的位姿估计,便于后续做手工编辑或物理编辑。
作者声称,这种方法在可编辑视频表示里取得了更好的视觉质量,同时还能兼容现有 3D 编辑工具链。
所属事件:TOM-GS:用时间不透明度调制实现可编辑视频(2 条相关)→
「研究」频道最新
- 讨论:为何没人开发神经网络检测AI文本?图像已有研究 — emeka_boris · 2026-07-30
- Agent做数学研究仍困难:代码生成陷入证书和库存 — doodlestein · 2026-07-30
- TorchSpec 实现大规模分离式推测解码训练,已被腾讯混元等采用 — zhyncs42 · 2026-07-30
- 算力狂飙:2028 年 AI 将解锁的十大科技突破 — Annual_Judge_7272 · 2026-07-30
- 揭秘 SOTA 深度研究架构:模型原生训练与 150 个子智能体 — SimonShaoleiDu · 2026-07-30
- 普林斯顿教授评 MIT 非凸优化新论文:未达悬赏要求 — HazanPrinceton · 2026-07-30