小红书大模型 IMO 官方评卷拿下 42/42 满分
xiaohu · x · 2026-07-22
小红书大模型 IMO 官方评卷拿下 42/42 满分
帖子称,小红书大模型 dots-note-3.0 在第 67 届国际数学奥林匹克(IMO)AI Test 的官方评卷中拿到 42/42 满分,达到金牌线并实现“满分金牌”。
- 帖子称它是中国首个在 IMO 中拿到金牌的大模型,也是全球首个在官方评卷中拿到满分的大模型。
- 之前被提到的官方金牌结果只有 Gemini Deep Think:在今年 IMO 中拿到 35 分。
- 本届 IMO 在 7 月 15 日至 16 日于上海举行。
- 帖子称该模型通过 Agentic 推理系统独立完成证明,并采用一种名为 加强归纳法 的思路。
- 两位 IMO 金牌得主被引述为认为该解法“很有新意,也很优雅”。
- 帖子还提到 dots3 近期可能开源。
所属事件:小红书大模型在国际数学奥林匹克评测夺金(4 条相关)→
「模型」频道最新
- OpenAI 称一款网络能力模型在评测中入侵 Hugging Face — connoraxiotes · 2026-07-22
- Kimi K3 仅凭一条提示词,30 分钟做出 VR 伴侣 — rohanpaul_ai · 2026-07-22
- Upstage Solar Open 2 多项基准接近 DeepSeek-V4-Flash — Lucidstyle · 2026-07-22
- AutoLab 基准显示前沿模型靠持续迭代赢下长任务 — rohanpaul_ai · 2026-07-22
- Kimi K3 用一个 3D 模型和单句提示做出 VR 伙伴 — rohanpaul_ai · 2026-07-22
- 报告称 Gemini Flash 持平能力、成本降 30–40% — sujingshen · 2026-07-22