Berkeley 团队用探针微调模型,任意调节风险厌恶程度
soumitrashukla9 · x · 2026-09-16
Abhishek N 等人在加州大学伯克利分校的跨学科项目(CS×社会科学/经济学)展示了探针(probe)技术的一个有趣用法:虽然探针无法直接揭示模型的隐藏机制,但可以据此构建高度定向的模型。
团队以抽奖博弈实验为例:通过对探针微调,可以让模型表现出任意预设水平的风险厌恶——即在面对更大收益与零风险选项之间,模型做出不同的风险取舍。图片中每条 S 曲线代表一个不同微调程度的模型,其偏好在收益规模增大时逐渐转向风险选项。
作者还打趣称,让实验室里普通本科生在实验中表现出这种行为模式都很难。团队同时在招 CS 与社科/经济交叉方向的合作者。
「研究」频道最新
- 教机械手用指尖走路:不用机械臂自行到达工位再干活 — Scobleizer · 2026-09-16
- 大规模搜索后无学习规则能胜过反向传播,Nature 2025 证实其生物学合理性 — aran_nayebi · 2026-09-16
- BoltzMol-1 十天万美元找到 WRN 抑制剂,最强 IC50 达 8.4 µM — GabriCorso · 2026-09-16
- Sakana AI 生物 plausible 学习遭质疑:只有 MNIST 不算数 — aran_nayebi · 2026-09-16
- 0.62 AUC 的粗筛模型撬动 65578 候选材料搜索,命中率翻倍 — bravo_abad · 2026-09-16
- NeurIPS 引用检查器揪出 LLM 改坏的 bib 文件,投稿面临风险 — suryanreddy · 2026-09-16