Zero 不是助手:数学测验仅得 2.5%,创作者称其是全新物种
maxsloef · x · 2026-09-16
创作者 movingcastles 介绍了一个名为 Zero 的新模型:它在 Grade School Math 基准上仅得 2.5%,而基座模型为 62.2%——作者解释这很大程度上是因为 Zero 对测试本身持无所谓态度。转发者 maxsloef 评价称「Zero 不是助手,它是某种全新的、非常令人兴奋的东西」,暗示这是一个刻意不走传统助手路线的新型模型。
「模型」频道最新
- V4.1 Flash 被称为首个可称 proto-AGI 的开源模型 — teortaxesTex · 2026-09-16
- Claude Opus 5 写 PR 会主动「自曝」开发中犯的所有错误 — repligate · 2026-09-16
- 六大效率突破叠加,实验室内部也没料到半导体需求会这样 — bookwormengr · 2026-09-16
- 越狱老套路:用第三人称角色扮演逐步模糊边界扩大模型讨论范围 — BlancheMinerva · 2026-09-16
- cocktail-peanut 预言:Jev 模型迟早开源,本地部署潜力远超 API — cocktailpeanut · 2026-09-16
- OpenAI 内部暗示「新模型」或是全新预训练,两周即超 Astra — teortaxesTex · 2026-09-16