斯坦福发布 RenderFormer-V2:Transformer 神经渲染支持异构场景
Stanford · hf · 2026-09-10
斯坦福在 Hugging Face 发布 RenderFormer-V2,一个基于 Transformer 的神经渲染模型。它采用两阶段序列到序列架构,配合改进的注意力机制,可处理多样的光传输效果,并支持异构场景原语,让神经渲染适配更复杂的真实场景。
「多模态」频道最新
- 用 Fable + Claude Code 把乐谱 PDF 和 wav 合成视频,流程将自动化进 mtdt — doodlestein · 2026-09-10
- 用 Suno 创作「机器人灭绝人类后留下的歌」:We Leave the Lights On — AIandDesign · 2026-09-10
- H3 Turbo 实时生成支持最多 9 张参考图,角色风格稳定 — boudaboy · 2026-09-10
- fal 改进媒体生成模型服务,用户称计费方式不再"扣得可疑" — nijfranck · 2026-09-10
- 7500 万播放神视频的复刻 prompt 首次流出,网友直呼要试 — techhalla · 2026-09-10
- Nitx Studio 接入「GPT Image 2.5」,称无需会画画也能出图 — aziz4ai · 2026-09-10