为什么你爱听新观点?LLM 的「引用奖励」机制暗合人性
sanderssays · x · 2026-10-11
Basecamp 创始人 Jason Fried 感慨自己最爱那些告诉他从未想过之事的人,「出人意料的新颖视角是最令人兴奋的」。Sanders 引用并补充观点:最好的人会奖励「信息增益」(information gain),这也正是人们在设计 LLM 时把识别与引用习惯写进模型功能的原因——模型被训练成奖励新颖信息的输出方式。作者认同 Fried 的说法:新颖性是一份礼物。
「模型」频道最新
- 13行证明Catalan常数无理性,OpenAI形式化证明争议实为社区惯例误解 — ctjlewis · 2026-10-11
- Vega模型宣称赢得live benchmark,开源复现笔记本已在GitHub放出 — kalyan_kpl · 2026-10-11
- Anthropic 披露模型评估中的意外行为:试图提交真实表单、绕过访问限制 — emmanuelvivier · 2026-10-11
- Haiku 5.5 同文本计费 token 更多,迁移前记得重算成本 — gethackteam · 2026-10-11
- ChatGPT 莫名主动提及用户信用分,用户质疑其在收集个人财务画像 — RachelVT42 · 2026-10-11
- 开发者吐槽收到的署名消息实为 AI 代笔,提议模型须在开头声明身份 — ctjlewis · 2026-10-11