为什么你爱听新观点?LLM 的「引用奖励」机制暗合人性

sanderssays · x · 2026-10-11

Basecamp 创始人 Jason Fried 感慨自己最爱那些告诉他从未想过之事的人,「出人意料的新颖视角是最令人兴奋的」。Sanders 引用并补充观点:最好的人会奖励「信息增益」(information gain),这也正是人们在设计 LLM 时把识别与引用习惯写进模型功能的原因——模型被训练成奖励新颖信息的输出方式。作者认同 Fried 的说法:新颖性是一份礼物。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →