端侧新标杆:Qwen2.5 2B 手机仅需1GB显存,MMLU提升至54.8
alexcovo_eth · x · 2026-08-17
Qwen2.5 2B 模型通过蒸馏旗舰版训练,实现了在手机端仅需约1GB显存(Q4KM)即可运行。模型原生支持262k上下文与Function Calling,采用全参数SFT而非LoRA。评测成绩提升显著:MMLU CoT从28.3增至54.8,GSM8K从33增至64。
「模型」频道最新
- GLM 5.3 网络安全评测表现亮眼,低成本优势利好防御性安全工作 — ccerrato147 · 2026-08-17
- GLM5.2 被曝在非中英文提示词中错误采样语言 — kalomaze · 2026-08-17
- GLM-5.3 深度实测:代码更整洁长任务无漂移 — khademinori · 2026-08-17
- 实测:Qwen 3.8 27B 在 SVG 动画生成上击败 GPT-5.6 Sol — Lirezh · 2026-08-17
- Seedance 2.5 登顶多图生视频基准,Elo 1400 领先 — rohanpaul_ai · 2026-08-17
- Qwen3.8 蒸馏版 9B/4B/2B 发布:MMLU 跑分翻倍 — alejandroll10 · 2026-08-17