llama-server 多模态推理遇报错:位置索引异常
Gold-Drag9242 · reddit · 2026-08-17
用户在 Windows + AMD 7900XTX (Vulkan) 环境下运行 llama-server 时,使用多模态模型提取图片数据频繁遭遇 non-consecutive token position 警告导致服务崩溃。该问题已持续数月,涉及 Gemma 和 Qwen 多个模型。尝试拆分 Prompt 可暂时规避,但针对 Qwen3.8-27B 依然失效,目前尚未找到根本解决方法。
「Infra」频道最新
- 算力壁垒极高:仅头部厂商能负担 — 0xsachi · 2026-08-17
- 华尔街日报:九大科技公司表外藏着 3 万亿美元 AI 义务 — alvelda · 2026-08-17
- DGX Spark 运行 Qwen3.8-27B GGUF 命令示例 — ariG23498 · 2026-08-17
- 手持 3090 显卡,如何入手本地部署 Qwen 3.8? — ozymandizz · 2026-08-17
- Qwen MLX 挑战赛上线,角逐本地模型最快推理 — corruptbytes · 2026-08-17
- 发布六年仍赚钱:NVIDIA A100 为何久战不衰 — Ok-Elevator5091 · 2026-08-17