DeepSeek-V4-Flash在llama.cpp Vulkan下陷死循环
KingCpzombie · reddit · 2026-08-04
一位开发者在尝试使用 llama.cpp Vulkan 版本(10216)本地部署 DeepSeek-V4-Flash(Q8KXL 量化版本)时遇到了“Doom Loop”无限循环问题。模型在输出有效内容前会连续重复生成无意义的提示词。
硬件与配置:
- 设备:双 7900XTX 显卡(48GB 显存)+ 9800X3D 处理器 + 192GB 内存。
- 参数:上下文长度设为 50 万,开启了最大推理努力(reasoningeffort:max),温度设为 1,Top-p 设为 0.95。
作者不确定是否需要直接从 GitHub 构建最新版本才能解决此问题。
「Infra」频道最新
- RTX 3060 勇闯 MiniMax-H3:5秒视频渲染耗时4分钟 — Robert_Brown_7425 · 2026-08-04
- 双卡 GH200 跑 DSv4-Flash:优化后吞吐破万 — Reddactor · 2026-08-04
- RTX 5090跑图实测:百万像素21:9视频4分钟生成 — AdmirablePainting368 · 2026-08-04
- 彭博:长鑫存储预计年底小量生产先进 LPDDR6 芯片 — AIFlow_ML · 2026-08-04
- Minimax-H3 多精度量化版登顶 HF 热榜,支持 ComfyUI — Abiray · 2026-08-04
- GPTQ-2D:将双侧自适应舍入降至立方级时间复杂度 — ISTA-DASLab · 2026-08-04