Qwen 3.8 27B 在某 Harness 下几乎不思考的测试
rosie254 · reddit · 2026-08-15
用户发现某 unknown harness 导致 Qwen 3.8 27B 几乎不进行推理思考,推测原因可能包括系统提示词设计、工具数量过多导致过载。测试设置使用了 xhigh 推理强度和 UD-Q4KXL 量化,系统提示词约 4k tokens,工具定义约 8k tokens。
「模型」频道最新
- Grok 4.6 展示生成交互式未来月球城的能力 — techartist_ · 2026-08-16
- Qwen3.8-27B-AEON-PURE 跑分炸裂,全通过神级测试 — StephanSturges · 2026-08-16
- DeepSeek 模型 0731 与 0813 版本过拟合现象引发技术热议 — teortaxesTex · 2026-08-16
- 实测 Muse Glimmer 30B 对决 Qwen 3.8 27B — MacaroonDancer · 2026-08-16
- Anthropic 拒填表单,Grok 却主动帮用户下单 — pswider · 2026-08-16
- Meta 宣布 Muse Glimmer 开源,但强力版仍锁闭 API — HaktanSuren · 2026-08-16