giffmana 与 NandoDF 交锋:LLM 至今做不好实验设计

giffmana · x · 2026-09-07

NandoDF 认为 LLM(他举例称 Fable 一类)在运行科学实验、分布外或不可验证领域泛化上表现糟糕,人们应清楚这种悲观是有依据的。giffmana 回应同意,称自己每隔几周就会实测模型在实验设计与「合理的分析及下一步推导」上的能力,结论是确实很差,但他不确定这是「暂时」还是「未来多年」都会存在的问题。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →