为 27B 模型自定义混合推理模式实测

TokenRingAI · reddit · 2026-08-15

作者发现某 27B 模型在 low 和 xhigh 推理模式之间存在行为断层,medium 模式会忽略指令并导致性能退化。通过混合 low 和 xhigh 的提示词,作者成功定义了一个新的 "high" 模式。该模式将推理块长度缩减至 xhigh 的 1/5,同时保持了接近 xhigh 的输出质量,显著提升了交互体验。文章附带了具体的 chat template 修改代码。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →