前沿 LLM 能评论证,却不该评新颖性

PlisSergey · x · 2026-07-26

作者认为,前沿 LLM 已经比人类更擅长判断论证质量。

但它们不应该被用来判断新颖性或想法质量。作者的意思是,人类本来就很难做好这件事,而 LLM 会更差;如果把新颖性判断也交给模型,研究领域可能会变成追逐“当下的伪科学潮流”。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →