Vector 研究员 Kelsey Allen 用 3DSPA 让生成视频更像物理世界
VectorInst · x · 2026-09-26
Vector 研究院成员、认知科学家 Kelsey Allen 在 2026 Vector AI Summit 上介绍认知科学与 AI 的双向塑造:当前学习系统难以解决新颖物理问题,而人类能靠精确的「心理模拟」轻松完成。
为弥合这一差距,Allen 提出 3DSPA(3D Semantic Point Autoencoder),像人类一样度量生成内容的物理真实性,并可量化地改进生成视频模型。这条「用人类认知能力反哺学习系统」的研究路线值得追踪。
「多模态」频道最新
- 动效设计师自评:Opus 5.5 一条 prompt 就逼近我的手绘动画 — motionbynick · 2026-09-26
- 用 Gemini 3.8 TTS 生成「自言自语哼歌」的松弛音频 — fofrAI · 2026-09-26
- 用 Seedance 2.5 生成火山口坠入异维度末日 POV 视频 — LudovicCreator · 2026-09-26
- MiniMax H3 视频生成翻车:角色参考图总被强行复刻成固定姿势 — Capnreynolds999 · 2026-09-26
- 「天际线旁浮出巨物」:AI 视频以假乱真名场面 — Ok-Kick5886 · 2026-09-26
- Claude 写词、Suno 作曲的监狱主题专辑迎来重制版 — ctjlewis · 2026-09-26