MIT与哈佛新研究:LLM尚不具备自主科学发现能力
davidmanheim · x · 2026-08-03
MIT 和哈佛大学联合发表论文《Evaluating Large Language Models in Scientific Discovery》,指出当前大语言模型距离真正的自主科学发现还有很大差距。
研究人员开发了名为 SDE 的新评估框架,将 LLM 从传统的静态多项选择测试中剥离出来,放入真实的开放式研究项目中进行测试。结果显示,尽管科技实验室每周都在宣称 AI 在生物、物理或化学领域取得突破,但几乎没有证据表明当前 AI 具备辅助科学发现的能力。
所属事件:MIT哈佛研究:LLM尚不具备自主科学发现能力(2 条相关)→
「研究」频道最新
- OpenAI 新论文探讨智能体在科学计算中的八大应用 — markjeffrey · 2026-08-03
- 开发者复现 GRPO 训练:无 KL 散度致模型奖励作弊 — malliktwts · 2026-08-03
- RL训练翻车:格式奖励如何摧毁Qwen模型推理能力 — malliktwts · 2026-08-03
- Meta开源SAM 3D Body:单图即可精准重建3D人体网格 — tom_doerr · 2026-08-03
- 研究:AI 说服力击败人类辩论冠军 — geoffreyirving · 2026-08-03
- 本周信息检索前沿论文:Meta、YouTube、腾讯共探 RAG 与生成式推荐 — _reachsumit · 2026-08-03