Meta 内部模型狂揽五项奥赛金牌,纯推理能力解题
机器之心 · wechat · 2026-08-07
Meta 宣布将其内部训练的 AI 模型(来自 MuseSpark 系列)送入五项 STEM 学科奥林匹克竞赛,全部获得金牌或金牌水平成绩,其中两项物理理论考试直接满分。
- 禁用工具:Meta 强调测试了纯粹的推理能力,模型全程被禁止使用搜索、编码和计算器。
- 行业横向对比:尽管成绩亮眼,但在 2026 年的坐标系下,奥数满分已被多家国内外实验室(如华为、小红书、Anthropic)达成。物理理论满分成为了更有分量的指标。
- 标尺失效警告:文章指出,随着多家实验室在一年内将奥赛从「难以企及」刷到「满分」,这类有标准答案的测试作为 AI 推理能力标尺的信息量正在急剧衰减。
所属事件:Meta AI 模型无工具辅助斩获五项 STEM 奥赛金牌(9 条相关)→
「漫话AGI」频道最新
- DeepMind 新论:LLM 缺失科学发现的「跳跃」能力,需结合多模态世界模型 — maier_ak · 2026-08-07
- 观点:LLM 无法实现科学飞跃,因其缺乏直觉跳跃能力 — maier_ak · 2026-08-07
- DeepMind 论文:LLM 擅长归纳与演绎,但无法实现科学突破的「直觉跳跃」 — maier_ak · 2026-08-07
- 观点:现有模型已够用,未来前沿模型将加剧组织智力分化 — dosco · 2026-08-07
- 微软 154 页论文曾引争议,现被视为 AGI 预言 — emollick · 2026-08-07
- 观点:头部大厂模型产出放缓,追赶者迎来弯道超车窗口 — generativist · 2026-08-07