Qwen 3.8 27B 实测:KV Cache f16 精度优于 q8_0
Felixls · reddit · 2026-08-20
作者在 AMD R9700 + ROCm 环境下测试 Qwen 3.8 27B 模型,发现 KV Cache 使用 f16 精度时,模型在结构化和自由输出上比 q80 更细致,思维链更准确,且在 12 万上下文后仍能保持记忆。作者指出此前一些差评可能源于测试了 q40 等低精度 KV Cache。附带了详细的 llama.cpp 配置文件。
「模型」频道最新
- 评论称 GPT-5.6 Sol 习惯上网搜而非解题 — zainhas · 2026-08-20
- SpaceXAI 换地 69 英亩,斥资 4000 万美元建公共设施 — chrisgrayson · 2026-08-20
- 怀念冷峻版 AI:网友求助绕过日益加严的客套话护栏 — Wargaming123A · 2026-08-20
- Artificial Analysis 新榜:p0 质优价快优势扩大 — jeff_weinstein · 2026-08-20
- Tim Sweeney 称 Sol 5.6 适合难题,Grok 胜在速度 — TimSweeneyEpic · 2026-08-20
- 语言学者感叹:新AI缺乏诗意,呼吁OpenAI开源o3 — repligate · 2026-08-20