125M 小模型对齐 200 倍大 LLM?学界争议 Jev 是否借鉴前作
zmkzmkz · x · 2026-09-25
围绕 typesafeai 新产品 Jev 的抽象设计与 autorubric 高度相似引发争议后,研究者 ashabrawy201 顺势指出:其 2024 年的 Statement Tuning 论文早在两年前就提出用 125M 参数的通用「决策」小模型,在未见任务上匹配 200 倍于己的大 LLM,推理端与 Jev 的决策头可对应。这是围绕「小模型 + 决策头」范式的优先权之争,也指向用超小模型替代大模型做分类/决策的可行路线。
「研究」频道最新
- 4400 美元在 RTX 5090 上预训练出媲美 Qwen2-1.5B 的开源 2B 模型 — IgorCarron · 2026-09-25
- 牛津等团队论文入选 NeurIPS:前沿 LRM 规则学习行为与人脑活动对齐 — sreejan_kumar · 2026-09-25
- bold_lab_ai 招聘:博后与研助 10 月 9 日截止,另招战略合作经理 — josephdviviano · 2026-09-25
- AIRA₂ 研究智能体登顶 MLE-bench,81.5% 胜人类基线 72.7% — mariofilhoml · 2026-09-25
- 验证集过拟合其实不算大事:AIRA₂ 论文消融给出实证 — mariofilhoml · 2026-09-25
- Nature 子刊:控制论+内感受框架打造自适应具身智能体 — AnnaCiaunica · 2026-09-25