Reddit 用户实测:Qwen27B 热门微调版疑似「缩思考」后被削弱
Brief-Effect9065 · reddit · 2026-09-03
有用户发帖吐槽 DavidAU 发布的 Qwen3.8-27B-TURBO-Fable-Cold-Fusion-735-882-Heretic-Uncensored 微调模型令人失望:作者大幅缩短了模型的思考时长,疑似导致能力受损(被「脑叶切除」)。
该用户用 DeepSeek harness 测试单文件 HTML 塔防游戏生成,无论简单还是详细 prompt,无论 low 还是 xhigh 模式,表现都差于原版模型和前代 Cold-Fusion-GAIN-V1.1,并质疑其 benchmark 分数来源。
「模型」频道最新
- 研究者吐槽:LLM 文档每句三四个习语,反而让人更读不懂 — ZeeshanZiaML · 2026-09-03
- Agent Arena 帕累托前沿上线,实时对比 57 个模型的任务成本与表现 — arena · 2026-09-03
- Gemini 3.8 Flash 重塑 Agent Arena 帕累托前沿,单任务成本仅 $0.22 — arena · 2026-09-03
- Gemini App 仍把 3.6 Flash 标为「新」,用户吐槽官方落后两代 — weswinder · 2026-09-03
- 实测 Meta Muse Spark 1.3 写码强劲:逼近顶级模型,价格仅三分之一 — DeryaTR_ · 2026-09-03
- Qwen3.8 Flash 高精度量化发布,自研 KLD 度量跑赢同类量化 — Dutchnamn · 2026-09-03