哈佛 MIT 研究称 LLM 尚不具备真正的科学发现能力
gerardsans · x · 2026-08-02
哈佛大学与麻省理工学院的研究人员发表论文指出,当前的大语言模型(LLM)距离真正的科学发现还差得很远。研究团队认为,现有的科学测试多为静态的选择题,模型的高分掩盖了其真实能力。为此,他们构建了一个名为 SDE 的新评估框架,将 LLM 置于真实的开放式研究项目中测试,结果发现科技实验室此前宣称的诸多 AI 科学突破实际上言过其实。
「研究」频道最新
- 新评测探索:AI自创问题引发多模型答案分歧 — HazanPrinceton · 2026-08-02
- 仅用 30 秒视频,新 AI 学会了跑酷 — Two Minute Papers · 2026-08-02
- 物理学家用冷原子造“微型宇宙”,实验验证时间起源 — skdh · 2026-08-02
- 多智能体 AI 综合分析 5100 篇论文,揭示长新冠机制 — alvelda · 2026-08-02
- 提出Jeffreys-Fisher-Rao中心:快速逼近对称KL散度质心 — FrnkNlsn · 2026-08-02
- 研究:真实 AI 使用量正重塑股市,高 AI 敏感度公司回报更高 — rohanpaul_ai · 2026-08-02