MedRSI 论文:自改进医疗 Agent 需慢注册机制守住 94.4% 准确率
rohanpaul_ai · x · 2026-09-23
Stanford+Oxford 论文 MedRSI 表明医疗 agent 可以从自身错误中自我改进,但前提是新能力必须先在后续新患者身上验证才能永久保留。论文揭示了自改进为何需要护栏:如果每个有潜力的新工具都立即加入,到第 30 轮、57 个工具时准确率会跌到 76.9%;而采用慢注册机制、只保留 18 个工具时,准确率维持在 94.4%。
两个核心机制:
- 按临床代价排错:优先修复可能造成更大临床危害的错误,而非只盯最高频错误
- 快发明慢注册:能力可以激进发明,但要经过多次独立评估、证明持续有效才能写入持久 agent
结论:让 agent 大胆发明,但永久性自我改动必须靠重复的独立评估来「挣得」席位。
所属事件:斯坦福与牛津发布首个医疗 Agent 递归自改进框架 MedRSI(2 条相关)→
「研究」频道最新
- Google 轻量排序头:YouTube 多任务实验周期从数周缩到数天 — _reachsumit · 2026-09-23
- Orthrus 系统统一嵌入与生成推理,迭代 RAG 吞吐最高提升 4.52 倍 — _reachsumit · 2026-09-23
- Spotify 论文:行为信号让 LLM 重排涨 13.3%,但会学成捷径 — _reachsumit · 2026-09-23
- CoVeR 论文:嵌入覆盖度门控砍掉 62-68% Agent 验证器调用 — _reachsumit · 2026-09-23
- Simons Institute 联合 Jane Street 招募小组研究项目,10月15日截止 — jasondeanlee · 2026-09-23
- jev-gc:给长跑 Agent 做可逆上下文垃圾回收的开源方案 — Maleficent_College57 · 2026-09-23