为什么还没有 SOTA 的开源图像编辑模型?
Rheumi · reddit · 2026-09-17
发帖人困惑:LLM、文生图(Krea2)、音乐(Yue2)、视频生成(Minimax H3)都已有足够好或 SOTA 级开源权重,唯独图像编辑长期缺位。
- Flux2-Klein 9B 勉强可用,但开箱即用的 reference-to-image 和大改动基本失败;且发布已 9 个月,在 AI 时间尺度上已属「上古」。
- Qwen Image 2.0 之后阿里对相关模型进行了门控,Hidream image o1.5 edit 也未开源,Z-image edit、krea2 edit 均无消息。
- 作者询问 2026 年是否有任何实验室能带来希望。
「多模态」频道最新
- PANORAMA 实现全景级图文对齐:每句话都带像素级分割掩码 — Panorama-grounding · 2026-09-17
- AI 产出天台级陶瓷产品摄影,品牌拍摄成本逻辑被改写 — sidahuj · 2026-09-17
- 8GB 的 4060 跑 34GB 模型:LTX2.5 本地生 10 秒视频仅 40 分钟 — BigBullshitta · 2026-09-17
- 《BREATHE OUT》:创作者分享首个 AI 电影制作尝试 — micheldoumit · 2026-09-17
- 玩家实测 Yue2 翻唱效果:表现令人惊喜 — MegaNecrosMegas2 · 2026-09-17
- Seedance+Gen-4+Lyria 全 AI 生成 12 分钟海洋神话短片《最后的灯》 — OddlightWorks · 2026-09-17