审稿人开始要求更大的开源模型,不再只看 8B 基线
chhaviyadav_ · x · 2026-07-25
研究圈开始不满足于 8B 了
这条帖子说,开放模型论文的审稿期待已经明显越过 8B 级别,评审开始要求在更大、更强的开源模型上做评估。
- 作者提到有人要求他们对 GPT-OSS(21B MoE) 做评测。
- 他们还指出,这类模型通常也需要进一步微调。
- 帖子的核心问题是:NeurIPS 论文现在大家到底在用哪些开源模型?
虽然内容很短,但它反映出一个明确变化:审稿人和研究社区正在要求更强的开放模型、更完整的评测覆盖,而不再满足于小模型基线。
所属事件:NeurIPS评审提高开源模型评测门槛(2 条相关)→
「研究」频道最新
- 商业化 AI 基准分差很小,可能只是噪声 — PerformanceRound7913 · 2026-07-25
- 发布博客预告:FrontierCode 智能体编码基准打平 — hardmaru · 2026-07-25
- 蒸馏后的小模型可能因更强泛化反超老师 — peterjliu · 2026-07-25
- Opus 5 在九项生物基准登顶,但仍有几项分析任务落后 — kenbwork · 2026-07-25
- ARC-AGI 新解读:符号 AI 正在回潮 — typewriters · 2026-07-25
- 媒体机构生成式AI使用研究招募记者访谈 — QVeraLiao · 2026-07-25