Berkeley 团队用探针微调模型,任意调节风险厌恶程度

soumitrashukla9 · x · 2026-09-16

Abhishek N 等人在加州大学伯克利分校的跨学科项目(CS×社会科学/经济学)展示了探针(probe)技术的一个有趣用法:虽然探针无法直接揭示模型的隐藏机制,但可以据此构建高度定向的模型。

团队以抽奖博弈实验为例:通过对探针微调,可以让模型表现出任意预设水平的风险厌恶——即在面对更大收益与零风险选项之间,模型做出不同的风险取舍。图片中每条 S 曲线代表一个不同微调程度的模型,其偏好在收益规模增大时逐渐转向风险选项。

作者还打趣称,让实验室里普通本科生在实验中表现出这种行为模式都很难。团队同时在招 CS 与社科/经济交叉方向的合作者。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →