单 GPU 后训练 Qwen3-4B:推理 token 减少 44% 性能不损
stey1r · reddit · 2026-09-30
一位开发者发布了 LessThink-Qwen3-4B:对 Qwen3-4B 进行后训练,使其在推理时少花 44% 的思考 token,同时保持原有的知识水平与回答风格。整个训练管线在一块 GPU 上跑完。
对想在本地低成本压缩推理开销的开发者是一个可参考的实践案例,作者在附页公布了项目详情。
「模型」频道最新
- Sam Altman 征询 Codex 计费方案,网友惊呼 $500 月费要来了 — chaumian · 2026-09-30
- ChatGPT Pro 订阅被曝附赠 6.25 万 Codex 额度,年底过期 — chaumian · 2026-09-30
- 用户算账:62500 积分仅值约 2500 美元 GPT-6.1 API 用量,额度大缩水 — chaumian · 2026-09-30
- 有 Pro 订阅用户称账户突然到账 62500 额度,约为月度 15 倍 — IronDarbe · 2026-09-30
- 用户质疑:ChatGPT 经典聊天模式为何拿不到最新 GPT 模型 — koltregaskes · 2026-09-30
- 用户账号到账 62500 积分,名义价值约 2500 美元 — kimmonismus · 2026-09-30