Meta AI模型五项STEM奥赛全夺金,物理满分并纠错官方答案
Meta官方宣布,为测试AI模型的真实推理能力,让其内部AI模型在禁用所有外部工具(如搜索、编程、计算器)的严格条件下参加了五项国际STEM奥林匹克竞赛,全部达到金牌级别成绩。其中,在亚洲物理奥赛和国际物理奥赛的理论考试中均获满分及金牌,在国际数学奥赛获金牌(位列人类前4%),在罗马尼亚数学大师赛达金牌水平,并在化学奥赛中斩获金牌。三项赛事为现场实时参与并获得了官方评分。这一成绩引发社区对纯大模型推理能力的热烈讨论。
已确认
- 竞赛成绩:模型在亚洲物理奥赛和国际物理奥赛理论考试中均获满分及金牌;在国际数学奥赛获金牌(位列人类前4%),在罗马尼亚数学大师赛达金牌水平,并在化学奥赛中斩获金牌。其中三项赛事为现场实时参与并获得了官方评分。
- 发现官方答案错误:在国际物理奥赛(IPhO)中,研究团队比对答案时发现模型与官方初版标准答案存在细微分歧。经组委会复核确认官方解答错误,避免了人类选手被误判扣分,组委会为此颁发了感谢信。
- 测试条件:测试全程严格禁用搜索、编程和计算器等外部辅助工具,以评估未受污染的真实推理水平。
尚未确认
- 模型的具体参数量及技术架构未在帖子中披露(@机器之心 提到该模型来自 MuseSpark 系列)。
- 化学奥赛的具体赛事全称未明确。
为什么重要
- 纯推理能力验证:此次测试有效检验了AI在无辅助情况下的真实逻辑水平。针对Gary Marcus关于“纯LLM无法解决复杂数学问题”的观点,@inductionheads 转发指出Meta此次表现构成了有力反驳。
- 社区反响:@shuchaabi 提到有网友幽默调侃,称小时候没拿过金牌的科研人员现在可以自己训练模型来拿奖,实现了一种“美好的闭环”。
2026-08-06 ~ 2026-08-07 · 9 条相关
一手来源
- Meta AI 挑战五项 STEM 奥赛,物理理论获满分并夺数学金牌 — AIatMeta ·
- AI横扫五大国际奥赛:物理理论满分夺金 — shuchaobi · 2026-08-06
- AI 参加国际物理奥赛夺金,反揪出官方答案错误 — shuchaobi · 2026-08-06
- 【源头】Meta AI 挑战五项 STEM 奥赛,物理理论获满分并夺数学金牌 — AIatMeta · 2026-08-06
- AI 拿遍物理、数学等五项奥赛金牌,网友调侃圆了科研人的童年梦 — shuchaobi · 2026-08-07
- Meta 模型无工具辅助拿下奥赛金牌,纯 LLM 数学推理引争议 — inductionheads · 2026-08-07
- Meta 模型参加五项国际 STEM 奥赛,均斩获金牌级成绩 — jack_w_rae · 2026-08-07
- Meta 模型斩获五项 STEM 奥林匹克竞赛金牌 — ilkamoi · 2026-08-07
另有 2 条近重复转述:PMinervini · 机器之心