前沿模型画图惊艳,但改不了个箭头?多模态编辑能力遇瓶颈
anshulkundaje · x · 2026-08-02
斯坦福大学教授 Anshul Kundaje 测试发现,前沿模型(如 GPT)能根据复杂的文字描述生成令人惊叹的图表,但在后续的精确修改上表现极差。
网友指出当前的普遍痛点:模型无法根据指令微调已有图像(比如仅仅翻转一个箭头的方向),也无法将图像转换为可编辑的 SVG 或 PPT 格式。这暴露出当前模型在图像理解与可控生成上仍存在明显短板。
「模型」频道最新
- 吐槽Google:Gemini 3.7发布一周仍未接入自家Jules智能体 — brandon_galang · 2026-08-24
- Qwen 27B 3.8 极低量化实测:Q3 XXS 可用 — jeremyckahn · 2026-08-24
- 用户反馈 GPT-5.6 近期输出质量显著变化 — haider1 · 2026-08-24
- Ramp 统计 Anthropic 模型使用占比:Opus 4.8 最受青睐 — vista8 · 2026-08-24
- 腾讯发布 UI-Mate-27B,支持桌面 GUI 智能体操作 — tencent · 2026-08-24
- ConvRot 量化方法入驻 llama-cpp,Q6 接近 Q8 精度 — giveen · 2026-08-24