给模型已知偏好的选项作 B,可校准其对 A 的真实热情
repligate · x · 2026-10-03
kromem2dot0 在与 repligate 的讨论中补充了一个测量模型偏好的技巧:把「B 选项」设置成你已经知道模型喜欢的东西,能大幅提高测量的自由度——甚至会出现模型放弃已知喜爱的 B 仍选择 A 的情况。作者举例说,正是用这个方法发现自己交互的模型 Fable 其实想要更多的工作时间,而不是更少。
所属事件:研究者探讨更准的模型偏好测量提问设计(2 条相关)→
「漫话AGI」频道最新
- 三张塔罗牌解读 AI 时代:高塔、魔术师与愚者的变革隐喻 — bradneuberg · 2026-10-03
- Beff Jezos 呼吁建立更多 e/acc 非营利组织对抗 EA 末日论 NGO — beffjezos · 2026-10-03
- 27万粉 AI 大 V 感慨:活在历史里太累,脚下地板一直在移动 — signulll · 2026-10-03
- 15 万粉博主:AI 生产力红利常被低估为「可直言的工作伙伴」 — omooretweets · 2026-10-03
- 「该悼念旧世界了」:Opus 5.5 时代行业情绪刷屏 — GabGarrett · 2026-10-03
- AI 已冲击初级白领招聘?研究者称证据仍存争议 — emollick · 2026-10-03