OpenAI 联合 80 余名临床医生发布开源心理健康评测基准 MentalHealthBench

coherence · x · 2026-09-24

OpenAI 发布了开源基准 MentalHealthBench,用于评估前沿模型在真实心理健康对话场景中的表现,基准由 80 多位心理健康临床医生参与构建,并开放方法供研究者复现与扩展。

Boris MPower 在转发时提出一个规律性观察:一旦某个能力被良好度量,模型通常会在一年内把该指标刷到饱和,并希望心理健康场景也能如此,让模型真正帮到亿万用户。

所属事件:OpenAI 联手 80 余位临床医生开源心理健康基准(11 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →