GPT-5 与 Gemini 2.5 Pro 达国际天文奥赛金牌水平

Nature Astronomy 发表的研究对五个最先进的大语言模型在国际天文与天体物理奥林匹克竞赛(IOAA)试题上进行了系统评测。这类题目远难于常规科学问答,需要深度概念理解、多步数学推导与多模态分析。结果显示 LLM 已达到金牌级表现,其中 Gemini 2.5 Pro 取得 85.6% 的高分,GPT-5 同样斩获金牌水平成绩。

2026-08-20 ~ 2026-08-21 · 2 条相关

另有 1 条近重复转述:bravo_abad