Canvas-to-Image 把身份、姿态和框统一到一张画布
CSProfKGD · x · 2026-07-23
Yusuf Dalva 在 SIGGRAPH 2026 上介绍 Canvas-to-Image(C2I),一种新的多模态图像生成控制范式:把所有控制信息都放进一张 RGB 画布里。
核心思路是用一个更直观的界面,替代分散的控制面板:
- 直接在画布里指定人物身份、姿态和框选区域
- 让系统理解这张设计图,再生成符合意图的图像
- 目标是把复杂生成流程收敛为一个统一的创作界面
这条帖同时把它放在图像生成和多模态可组合控制的研究语境里。
「多模态」频道最新
- HeyGen 推出 Companion Mode,主打分镜审批式视频创作 — HeyGen · 2026-07-23
- 单张 RTX 5090 从零训图像模型,先被各种离谱 bug 拖崩 — Creative-Listen-6847 · 2026-07-23
- 开源印地语转写模型宣称优于 ElevenLabs — TrelisResearch · 2026-07-23
- OpenAI Build Week 项目让摄像头背景不用绿幕也能更自然 — cjami · 2026-07-23
- Nano Banana 2 修掉了 Midjourney 的鸟爪畸形 — michaelrabone · 2026-07-23
- 开源 Skill 把提示词变成印刷质感海报 — floguo · 2026-07-23