3B参数图像转SVG新模型HiVG,击败GPT-5等7大闭源模型
tom_doerr · x · 2026-08-04
GitHub 开源项目 HiVG(Hierarchical SVG Tokenization)能够将各类图像高保真地转换为干净、可编辑的 SVG 矢量图,忠实保留原图的结构、布局与细节。
核心亮点:
- 以小博大:仅 3B 参数,但在图像转 SVG 任务上击败了包含 GPT-5 和 Gemini 2.5 在内的 7 个顶级闭源模型。
- 高效压缩:提出分层 Tokenization 技术(原始 SVG → 原子 Token → 片段 Token),实现了 2.76 倍的序列压缩。
「多模态」频道最新
- WaiT 模型:引入小波感知流匹配,刷新像素空间 FID 记录 — chaumian · 2026-08-04
- 纯靠提示词开发:开发者用多款大模型打造浏览器 3D FPS 游戏 — rudesssolo · 2026-08-04
- 探讨用 AI 迭代生成高质量 LoRA 训练集的最佳工作流 — Sudden-Complaint7037 · 2026-08-04
- 实测 MiniMax H3 模型:流畅生成人群动态视频 — takayatodoroki · 2026-08-04
- 无需影楼:如何用单张照片与 AI 迭代生成高质量 LoRA 训练集 — Sudden-Complaint7037 · 2026-08-04
- MiniMax H3 视频生成实测:对 IP 版权内容的处理表现优异 — animovirtus · 2026-08-04