前沿 LLM 能评论证,却不该评新颖性
PlisSergey · x · 2026-07-26
作者认为,前沿 LLM 已经比人类更擅长判断论证质量。
但它们不应该被用来判断新颖性或想法质量。作者的意思是,人类本来就很难做好这件事,而 LLM 会更差;如果把新颖性判断也交给模型,研究领域可能会变成追逐“当下的伪科学潮流”。
「漫话AGI」频道最新
- 前 OpenAI 研究员:编程语言正蜕变为机对机暗语 — eptwts · 2026-07-26
- 黄仁勋称智能体是新的软件,AI 会创造更多岗位 — garrytan · 2026-07-26
- 调查:多数人愿接受人类增强技术,但呼吁严格监管 — Chris_Armstrong · 2026-07-26
- 工业革命数十年人均GDP仅增20%,AI经济红利为何迟到 — sebkrier · 2026-07-26
- 投资人反思:重金投入免费开源大模型是高风险策略 — ghadfield · 2026-07-26
- AI做研究不可靠?关键在于生成与验证流程的深度结合 — joshgans · 2026-07-26