ECCV 2026 报告:拆解多模态基础模型的内部表征
abursuc · x · 2026-09-08
作者预告 ECCV 2026 会议上备受期待的收尾报告:lorenzobaraldi 主讲「Looking inside Multimodal Foundation Models: Representations on the Interface」,主题是从控制性与可靠性视角审视多模态基础模型的内部表征机制。
「多模态」频道最新
- Deemos 推出 Hyper3D MCP,在 Codex 里用提示词直接生成 3D 模型 — sidahuj · 2026-09-08
- ID-V2V 权重上架 Hugging Face:基于 Wan 2.1+VACE,双 checkpoint 可选 — minchoi · 2026-09-08
- Netflix 开源 ID-V2V:换视频整体风格但保住人脸与口型 — minchoi · 2026-09-08
- 单人脸镜头视频生成难?双起始帧分别生成再拼接的实操技巧 — cocktailpeanut · 2026-09-08
- Minimax H3 实测:一张图加音频生成唱跳视频,6 步 768p 半小时 — aziib · 2026-09-08
- 用 ComfyUI 插件继承前段 latent,MiniMax H3 实现视频无缝续拍 — blackdatafilms · 2026-09-08