微调 Qwen3 4B 反超 Claude Sonnet,更便宜更快
wonderwomancode · x · 2026-10-02
svpino 转发一组微调实测结果:在 AWS 上对 Qwen3 4B 做微调后,其表现超过了开箱即用的原模型和 Claude Sonnet 4.6,同时运行成本更低、速度更快。作者称「遇到的每家公司都想要这样的效果」——用小模型微调在特定任务上以更低成本替代前沿大模型。原帖附结果链接,具体基准数据需看原文。
「模型」频道最新
- ThursdAI 周报:GPT-6.1 Sol、Sonnet 5.5、Gemini 4 Argon 同周齐发 — altryne · 2026-10-02
- Claude Max 用户:Opus/Sonnet 用量近乎无限 — petergyang · 2026-10-02
- Gemini 配额今晨 10 点重置,网友提醒抓紧用 Ultra 额度 — Bloated_Plaid · 2026-10-02
- Gemini 4 Pro Argon 疑似仅极少数人可用,谷歌基准亮眼放开却极少 — gaganghotra_ · 2026-10-02
- Yacine吐槽:Opus 5.5安全护栏对无关内容疯狂触发 — yacineMTB · 2026-10-02
- GPT-6.1-sol实测:基础智能重回水准是最大亮点 — haider1 · 2026-10-02