新基准测 VLM 画 ASCII 图
East-Muffin-6472 · reddit · 2026-07-20
ASCIITermDraw-Bench 是一个新的基准,用来测试视觉语言模型能不能正确生成和编辑 ASCII 图。作者认为,ASCII 图在表达架构、网络拓扑、集群关系时很实用,而这和“把图描述出来”不是一回事。基准一共包含 80 个任务,分成四类:基础方框布局、网络拓扑、软件架构图,以及基于图片输入的图编辑。评测时同时看结构分数和 LLM 语义裁判分数,并对每题重复 5 次,再给出 95% 置信区间。当前榜单里,Gemma-4-31B-IT 领先,其后是 Qwen3.7-Plus、Kimi-K2.6、MiniMax-M3、Qwen3.5-9B 和 Ternary-Bonsai-27B。
所属事件:ASCIITermDraw-Bench评测VLM画ASCII图(2 条相关)→
「多模态」频道最新
- Reddit 用户串联 Ideogram 4 和 Krea2,复刻 bbox 定位效果 — v3lh0t05c0 · 2026-07-22
- ComfyUI多脸修复神器:Ultimate Face Fix节点开源 — Merserk13 · 2026-07-22
- AI 视频制作入坑指南:如何解决连贯性与审查限制 — cynicalnewenglander · 2026-07-22
- 先做分镜再生成,AI 舞蹈视频更容易保持一致性 — aftahi_ai · 2026-07-22
- Runpod MCP 让 Claude 直接编排图像和视频生成工作流 — 802high · 2026-07-22
- Midjourney 把蜜蜂做成碎片爆炸梗图 — michaelrabone · 2026-07-22