ASCIITermDraw 基准评估模型是否会画 ASCII 图
East-Muffin-6472 · reddit · 2026-07-22
ASCIITermDraw-Bench 是一个测试 VLM 是否能生成和编辑 ASCII 图示的基准。
- 覆盖方框布局、网络拓扑、软件架构图和基于图片的图示编辑。
- 目标是衡量 AI 助手能否用纯文本可靠地表达初始架构想法。
- 评估同时看结构与语义,包含 80 个任务,并给出了 Gemma-4-31B-IT、Qwen3.7-Plus、Kimi-K2.6 等模型的榜单。
所属事件:ASCIITermDraw 基准测试模型生成与编辑 ASCII 图能力(2 条相关)→
「研究」频道最新
- 视频课程讲解物理约束机器学习的建模与控制 — Vjeux · 2026-07-22
- 健康时间序列基准显示 LLM 仍落后传统机器学习 — yang_yuzhe · 2026-07-22
- AutoLab 基准显示前沿模型靠持续迭代赢下长任务 — rohanpaul_ai · 2026-07-22
- 报告称 Gemini Flash 持平能力、成本降 30–40% — sujingshen · 2026-07-22
- Delineate Anything v2 用 7300 万实例数据集做全球农田边界识别 — Mykola Lavreniuk · 2026-07-22
- KernelBench 新增 CUDA 子基准,并在三种 GPU 上重跑 Fable — TheZachMueller · 2026-07-22