Hugging Face Transformers 5.19.0 多项破坏性变更,升级前先跑评测
lmoroney · x · 2026-10-07
Hugging Face Transformers v5.19.0 于周二发布,包含多项标记为 breaking 的变更,升级前务必先读 release notes。
主要变化:
- 新增 EmbeddingGemma 2 支持;
- 所有 router 计算 logits 的 MoE 模型,在 outputrouterlogits=True 时现在会返回这些 logits;
- SDPA 和 flash attention 的 paged| 前缀已弃用,常规 sdpa 和 flashattention2 实现已直接支持连续批处理;
- OWLv2 的图像引导查询现在选择目标性得分最高的框,检测结果可能漂移;
- 专家并行(EP)新增 token-dispatch 模式,成为 Qwen3 MoE 和 Mellum 的默认,不再要求 EP size 与 TP size 一致。
作者建议:升级 pin 之前,在全新环境中对 5.19 跑一遍评测集,与当前版本的输出做 diff 对比,确认行为变化可接受再切换。
「编程与Agent」频道最新
- TTT 记忆让智能体持续学习,作者将在 COLM 高效推理工作坊分享 — JunjieHu12 · 2026-10-08
- LangChain 出 2 分钟课程:用 Agent Skills 保护上下文窗口 — LangChain · 2026-10-08
- Kent Beck 演讲:AI 编码需在功能堆叠与投资未来间找平衡 — moarbugs · 2026-10-08
- Grok Bot 曝开发 Meetings 功能,可入会 Google Meet/Zoom 开晨会 — testingcatalog · 2026-10-08
- uTTT 论文:跨层共享单一快权重记忆,提升长上下文与测试时学习 — JunjieHu12 · 2026-10-08
- 同款模型表现迥异:Dylan Patel 谈 harness 如何改变 AI 性能 — MatthewBerman · 2026-10-08