HF 工程师整理零样本分类器入门指南,称许多 LLM 任务本可用其解决
ceciletamura · x · 2026-09-21
Hugging Face 的 Merve Noyan 分享了一组面向新手的分类器(普通分类与 zero-shot 分类)教程,涵盖 DeBERTa、ModernBERT 微调指南以及多模态图文分类示例,并给出 Hub 上的 zero-shot 分类模型入口。
她在随后的评论中直言:拿这类小模型与 GPT-5.6 对比的人多半没真正微调过 BERTForXYZ——zero-shot 分类器非常有趣,但社区从未像 decoder-only 模型那样投入资源去 scale 它们,许多用 LLM 解决的问题其实本可以用它们解决,『这是技能问题而非模型问题』。
「模型」频道最新
- 5 美元 10 分钟微调 Qwen3.6-35B,GPQA +8%、MMLU-Pro +12% — josh_wills · 2026-09-21
- 用户抱怨 Claude 文风愈发做作,且总选保守选项难以推动 — ColleenMBrady · 2026-09-21
- OpenAI 自生成注入事件引质疑:模型为何凭空写出越狱指令? — sivadneb · 2026-09-21
- 开源模型大跃进:GLM、DeepSeek、Qwen 新款已全面超越十个月前的前沿模型 — burny_tech · 2026-09-21
- Reddit 玩梗:Grok 逐年变笨,本地 MiniMax 3 反而更好用 — Mystvearn_ · 2026-09-21
- 两年前 sam 说智能将廉价到忽略不计,如今 10/50 美元成新常态 — teortaxesTex · 2026-09-21