MentalHealthBench 测评:前沿模型稳步进步,但差距仍明显

thekaransinghal · x · 2026-09-24

MentalHealthBench 的分数显示,前沿模型应对真实心理健康场景的能力在稳步提升,但模型间差异明显。改进空间主要在于两点:更主动地向用户追问上下文,以及支持用户自己做出决定而非替用户决定。

所属事件:OpenAI 联手 80 余位临床医生开源心理健康基准(11 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →