llama.cpp 合入 GLM-5.2-Vision 本地多模态支持
QuixiAI · x · 2026-07-27
llama.cpp 已合入对 GLM-5.2-Vision 的支持,补上了多模态转换和运行时处理能力。
这次更新包括:
- 将 GLM-5V 注册到 kimivl 转换后端
- 新增专用的 glm5v vision projector 类型
- 复用现有的 Kimi-K2.5 MoonViT3d 编码器实现
- 同步调整 tensor 命名、mtmd 加载器、graph builder、图像预处理、动态 token 计算和 embedding 逻辑
- 使用 <beginofimage> / <endofimage> 作为图像分隔符
可以理解为,这个视觉模型现在已经能更顺畅地进入本地推理栈。
「Infra」频道最新
- 开源剖析器可追踪语音 Agent 每次 STT、LLM、TTS 调用 — mahimairaja · 2026-07-27
- SemiAnalysis 认为推理时代内存和存储比更快 GPU 更关键 — rwang07 · 2026-07-27
- 自建 LLM 服务器让作者意识到,自托管最难的是可靠性 — MaxChamp08 · 2026-07-27
- 便宜存储让 SCD Type 2 显得过时,作者主张改用每日快照 — Zachly · 2026-07-27
- HuggingHack 增加 S3、MinIO、Ollama 和 vLLM 调度 — TyedalWaves · 2026-07-27
- Copilot 变免费后,他在想要不要卖掉双卡 AI 主机 — tweetibird · 2026-07-27