小红书 dots-note-3.0 IMO 满分夺金,成全球第二个金牌模型
量子位 · wechat · 2026-07-21
小红书 dots-note-3.0 在 IMO 官方评测拿到满分金牌
据 IMO 官方评定,小红书大模型 dots-note-3.0 六道题全部答对,拿下 42/42 满分,成为 中国大模型首次获得 IMO 官方金牌认证 的模型,也是继谷歌 Gemini 之后全球第二个达到这一成绩的模型。
- 这次成绩是 满分金牌,不是“接近满分”。
- 模型从读题、解析到写证明,几乎全程使用 自然语言端到端 完成。
- 评审认为它的部分解法不仅正确,而且 结构紧凑、逻辑优雅,甚至走出了非常规但成立的路径。
- 文中强调 IMO 的价值在于:题目 赛前保密、现场按 正式竞赛流程 评审,比普通 benchmark 更难“背题”或包装。
- 模型还采用了 自然语言 + Python 执行 的智能体式推理,并带有自我批判过程。
这篇稿子把这个结果解读为:小红书在基础模型领域已经拿出了一份足够硬的成绩单,且该模型据称即将开源。
所属事件:小红书 dots-note3.0 满分斩获 IMO 金牌(2 条相关)→
「模型」频道最新
- Google 发布 Gemini 3.6 Flash,3.5 Pro 仍在测试 — Ars Technica AI · 2026-07-22
- Google 透露 Gemini 3.5 Pro 已进入伙伴测试,Gemini 4 开始预训练 — haider1 · 2026-07-22
- 一张基准图把 flash 模型排到第 5,质疑点是太贵了 — soumitrashukla9 · 2026-07-22
- 如何辨别大模型真实的 Token 效率与“偷工减料”的简短回答? — ruthstarkman · 2026-07-22
- Google 传出上线 Gemini 3.6 Flash 等三款新模型 — gaganghotra_ · 2026-07-22
- Google 推出三款 Gemini Flash,3.5 Pro 仍在训练中 — The Decoder · 2026-07-22