复旦提出四级框架,梳理从生成模型到 Agentic 视觉生成演进
Fudan-University · hf · 2026-09-09
复旦大学团队发布综述/框架论文 Agentic Visual Generation,按控制器对生成操作决策范围的直接程度,提出四级分类框架:
- 从固定支持(fixed support)
- 逐步升级到经验自适应控制(experience-adaptive control)
该框架梳理了视觉生成从传统生成模型向 agentic 控制范式演进的技术路线。
「多模态」频道最新
- Mask Forcing:双噪声掩码蒸馏缓解自回归视频扩散模式坍塌 — Zhuoran Zhao · 2026-09-09
- 开发者自制工具实现半透明蓝晒风 AI 纸片动画 — floguo · 2026-09-09
- 新图像模型引发刷屏级沉迷,圈内人集体上头 — Dimillian · 2026-09-09
- 重度 Grok Bot 用户对比 Meta Muse:第一印象实测出炉 — Scobleizer · 2026-09-09
- fal 研究者将亮相巴黎 Three.js 大会,三场活动覆盖视频模型训练与 AI+3D — OdinLovis · 2026-09-09
- 网友用 MiniMax H3 图生视频复刻 GTA VI 像素风动画 — Time-Ad-7720 · 2026-09-09