TT-VidT 时序解耦视频预训练方法入选 NeurIPS
CMHungSteven · x · 2026-09-29
Spellbrush 研究员 KBlueleaf 宣布其视频生成研究 TT-VidT 被 NeurIPS 接收。该方法在视频预训练中采用时序解耦(temporal-decoupled)思路,从视频中显式提取真实的运动信息,且只需小规模训练即可达到高质量生成效果。合作方包括 NVIDIA 与 Spellbrush。
「研究」频道最新
- ColNanoVDR 免文档蒸馏多向量检索,149M 小模型保住 95% 检索精度 — nanovdr · 2026-09-29
- 重设计 DiT 残差连接:训练迭代减少 1.73 倍,FID 降至 1.39 — NationalUniversityofSingapore · 2026-09-29
- Imprint Reader:让模型用自然语言解读自身权重更新 — Guanxu Chen · 2026-09-29
- 上交大 GeoVerse:在几何潜空间合成世界一致的新视角 — SJTU · 2026-09-29
- 腾讯混元给出无编码器多模态预训练 Scaling Law:10^22 FLOPs 处反超 — Tencent-Hunyuan · 2026-09-29
- 表征工程何时有用?LLM 安全控制与监控的公平对决 — Tianyi Guan · 2026-09-29