研究者点破 LLM 验证软肋:「核查」无法形式化保证

anshulkundaje · x · 2026-09-29

斯坦福研究者 Michael Zlin(经 Anshul Kundaje 转发)指出 AI 系统在科学发现任务中的一个深层局限:即使模型生成的候选集覆盖足够,其「核查」环节也无法形式化验证——没有任何机制能保证模型真的验证了一条声明,而不是生成了一段听起来很流畅的验证文本。这一坦率反思引发了对 AI 自主科研可靠性的讨论:输出流利不等于推理可信,形式化保证的缺失是当前 LLM 做科学验证的硬伤。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →