一个 Qwen 3.6 27B 衍生模型声称推理 token 减少 90% 以上
AppealSame4367 · reddit · 2026-07-23
一个 Qwen 27B 衍生模型声称少用 90% 以上推理 token
这条 Reddit 帖子提到 Hugging Face 上的 ProCreations/grug-27b,并转述了几个值得注意的点:
- 它被标成 Qwen 3.6 27B 的衍生版本
- 仓库 benchmark 的主张是:思考阶段所需 token 可减少 90% 以上
- 发帖人认为,如果属实,那他在老笔记本上以 3 TPS 跑 27B 的体感会接近快得多
不过发帖人自己还没测试,所以这条目前仍属于“看到一个有意思的模型 claim”,不是已验证结论。
「模型」频道最新
- 谷歌 Gemini 3.5 Flash 被指定位为高性价比工作流模型 — koltregaskes · 2026-07-23
- 另一条回复称 Grok 还是没把球队数算对 — ivan_bezdomny · 2026-07-23
- 有用户说,Grok 4.5 high 已成他的日常首选 — prasenx · 2026-07-23
- Grok 在长球队清单题上误算,还一直试图辩解 — ivan_bezdomny · 2026-07-23
- 有用户称 ChatGPT 连简单排名题都开始答错 — ivan_bezdomny · 2026-07-23
- 传闻 Codex 将把 GPT-5.6 Sol spark 跑到 750 tok/s — haider1 · 2026-07-23