「Jev 不是 LLM」引争论:BERT 系也是语言模型,零样本分类器被低估
RexDouglass · x · 2026-09-20
围绕新模型 Jev 的定位在 X 上引发讨论。MaziyarPanahi 引用「Jev isn't an LLM」指出 BERT、DeBERTa、ModernBERT 这类模型都是语言模型,很多人混淆了「LLM」与「语言模型/Transformer」的含义。mervenoyann 转发吐槽:拿 Jev 去跟 GPT-5.6 比的人,多半没靠微调 BERTForXYZ 吃过饭;她还表示一直觉得零样本分类器很有意思,可惜社区从没像 decoder-only 模型那样投入资源去规模化它们——许多用 LLM 解决的问题其实用零样本分类器就能搞定,「这是水平问题(skill issue)」。
「模型」频道最新
- 连续 100 次电车难题测试:Jev 首轮 99% 选择拉杆救人 — FinanceYF5 · 2026-09-20
- 实测并行采样决策模型 Jev:路由决策约 1 秒,快普通 LLM 十倍 — TigerOk4538 · 2026-09-20
- 研究者观察:模型「工作记忆」随规模扩大,新模型可同时装下更多信息 — repligate · 2026-09-20
- Burkov 质疑斯坦福 AI Index:美国 59 个知名模型被高估 — burkov · 2026-09-20
- JEV 引入国内观察者:不说话、直接输出类型化概率决策的模型 — sven_ai · 2026-09-20
- JEV 引发热议:模型规模、校准可靠性与微调接口成待解问题 — vykthur · 2026-09-20