让 AI 实习当医生:谷歌让 Gemini 做近 5 万次问诊模拟
SRSchmidgall · x · 2026-08-12
Google 研究人员提出 ResidencyRL 训练框架,让 Gemini 3.5 Flash 经历了类似人类医生的“模拟实习”。
- 训练规模:模型在涵盖 81 种疾病的 49,870 次模拟远程问诊中进行训练。
- 对抗环境:模拟的 AI 患者会刻意隐藏症状、拒绝建议或提出不合理要求,迫使模型在长达 60 轮的对话中主动收集信息。
- 效果显著:在对抗条件下,诊断准确率从 81% 提升至 88%,漏诊危险症状的情况减少了 31%。
- 专家盲测:在 97 个案例的盲测中,临床医生在 87.6% 的情况下更偏好经过训练的模型。
此外,这种能力提升还能泛化到未见过的肿瘤学案例和外部基准测试中。
所属事件:谷歌推出ResidencyRL框架用强化学习训练AI医生(10 条相关)→
「模型」频道最新
- 悬置21年数学难题被人类破解,GPT与Claude均告失败 — anshulkundaje · 2026-08-13
- 像艺术评论家一样评测 AI:Grok 4.6 占星能力实测 — karinanguyen · 2026-08-13
- Kimi K3 接入 GitHub Copilot,实测一句话生成游戏 — film_girl · 2026-08-13
- MiniMax H3 实测对比 SD2.5:运镜更平滑,商业可用性占优 — FellMentKE · 2026-08-13
- 80张RTX 5090跑满Kimi K3全量模型,Bittensor网络提供半价平替API — markjeffrey · 2026-08-13
- Grok 4.6 上线 Cursor 等平台,首周提供双倍用量 — XFreeze · 2026-08-13