RelightFormer:前馈 Transformer 实现单视图与多视图物体重光照
PolyUHK · hf · 2026-09-09
PolyUHK 团队提出 RelightFormer,一个前馈生成式 Transformer,可直接对单视图或多视图图像做重光照。
- 通过 cross-attention 注入目标光照条件
- 用置换不变编码处理无序多视图输入,无需固定视角顺序
- 在大规模合成数据集上训练
相比传统基于物理或优化的重光照流程,前馈架构推理更快,适合单图和多视角物体重建光照的场景。
「多模态」频道最新
- 外星星球手持 vlog 风格文生视频 Prompt 完整模板分享 — techhalla · 2026-09-09
- 开源 VoiceStudio 复刻 ElevenLabs 全家桶:646 种语言全本地运行 — thisguyknowsai · 2026-09-09
- 实测对比:OpenAI image-2.5 低于 1 美分、23 秒出图明显更强 — tobowers · 2026-09-09
- GPT 图像模型直接产出 10 秒 GIF,网友惊呼将抢视频模型饭碗 — rounak · 2026-09-09
- AI 短片署名起争议:TapNow 指控他人抹水印冒充产品演示 — TomLikesRobots · 2026-09-09
- Marigold V2 用单步流匹配改造 DiT,单目深度估计更强 — huawei-bayerlab · 2026-09-09