RLFR 用内部探针降幻觉37%

burny_tech · x · 2026-07-15

Goodfire 团队开发了 RLFR:把模型内部的 probes 当作强化学习奖励信号来训练。

他们称 Silico 在 2 天内复现了这项方法,并在 Qwen3-8B 上将幻觉率降低 37%,同时没有带来能力损失。

所属事件:RLFR新方法利用内部探针降低大模型幻觉(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →