RLFR 用内部探针降幻觉37%
burny_tech · x · 2026-07-15
Goodfire 团队开发了 RLFR:把模型内部的 probes 当作强化学习奖励信号来训练。
他们称 Silico 在 2 天内复现了这项方法,并在 Qwen3-8B 上将幻觉率降低 37%,同时没有带来能力损失。
所属事件:RLFR新方法利用内部探针降低大模型幻觉(3 条相关)→
「模型」频道最新
- 不改模型给 Qwen3-8B 加近似层,预填充时间砍半 — teortaxesTex · 2026-09-11
- Schmidhuber?不,是 rschu:Pro 20x 套餐不到一天烧掉 60% 额度 — rschu · 2026-09-11
- Google Grounded Search 计费翻车:15000次请求仅289次计入免费额度 — ItalyExpat · 2026-09-11
- 网友热议 DeepSeek 新模型:K3 还是缩水版 K3-Flash? — teortaxesTex · 2026-09-11
- DeepSeek 新版多轮改 System Prompt 不再击穿缓存,费用省 36.6% — teortaxesTex · 2026-09-11
- 6TB Fable 数据遭倒卖:内含小米华为等企业泄露密钥 — teortaxesTex · 2026-09-11