为 27B 模型自定义混合推理模式实测
TokenRingAI · reddit · 2026-08-15
作者发现某 27B 模型在 low 和 xhigh 推理模式之间存在行为断层,medium 模式会忽略指令并导致性能退化。通过混合 low 和 xhigh 的提示词,作者成功定义了一个新的 "high" 模式。该模式将推理块长度缩减至 xhigh 的 1/5,同时保持了接近 xhigh 的输出质量,显著提升了交互体验。文章附带了具体的 chat template 修改代码。
「模型」频道最新
- 推测 Anthropic 内部模型进展可能放缓 — haider1 · 2026-08-15
- 阿里 Qwen 3.8 35BA3B 模型疑似现身代码提交 — BazzyIm · 2026-08-15
- DeepSWE 评测数据引发对 Fable 模型再思考 — teortaxesTex · 2026-08-15
- 实测 GLM-5.3:编程对标 GPT-4,我以此开发了三款插件 — 赛博禅心 · 2026-08-15
- 实测 Qwen3.8-27b 水面渲染效果超越 Gemini Flash — pbaylies · 2026-08-15
- OpenAI 宣布 GPT-5.6 Luna 成为 ChatGPT 免费版默认模型,推 Think 按钮 — emmanuelvivier · 2026-08-15