llama-server 多模态推理遇报错:位置索引异常

Gold-Drag9242 · reddit · 2026-08-17

用户在 Windows + AMD 7900XTX (Vulkan) 环境下运行 llama-server 时,使用多模态模型提取图片数据频繁遭遇 non-consecutive token position 警告导致服务崩溃。该问题已持续数月,涉及 Gemma 和 Qwen 多个模型。尝试拆分 Prompt 可暂时规避,但针对 Qwen3.8-27B 依然失效,目前尚未找到根本解决方法。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →