斯坦福试验称 GPT-4 单独作答胜过医生,非专家反而变差
jonc101x · x · 2026-07-29
斯坦福医生试验发现:GPT-4 在部分任务上能胜过医生
据帖中转述,斯坦福负责医学生 AI 教育的 Jonathan Chen 医生亲自做了一项真人试验,结果很反直觉:
- 医生只用互联网检索时,表现不错。
- 医生配合 GPT-4 时,整体表现和只用互联网差不多。
- 只让模型独立作答时,GPT-4 的成绩超过了研究中的每一位医生,甚至包括那些开着模型界面的医生。
- 但对没有医学训练的人来说,模型反而让结果变差,比他们自己猜还差。
他还回放了一段自己曾经与临终患者妻子的真实对话,认为聊天机器人给出的安慰和沟通建议比自己当时做得更好。把这段转录放给 300 名医生看时,现场甚至响起了掌声,但他随后提醒大家:他们是在为一个 chatbot 鼓掌。
「漫话AGI」频道最新
- 行为经济学新研究:AI 参与会瓦解人类合作的社会规范 — steverathje2 · 2026-07-30
- 吴恩达新公司岗位设置引发思考:AI 时代工程师重归创造者 — oran_ge · 2026-07-30
- GPT-6将实现自我迭代优化推理算力 — imjustnewatai · 2026-07-30
- NBER 讲座探讨:AI 生成数据将颠覆经济学实证研究 — TaniaBabina · 2026-07-30
- LessWrong 深度长文:用 RL 与搜索构建 AGI 为何令人恐惧 — DKokotajlo · 2026-07-30
- AI 研究圈出现分化:顶尖人才因抗拒共识而闭门造车 — fkasummer · 2026-07-30