OpenAI 联合 80 余名临床医生发布开源心理健康评测基准 MentalHealthBench
coherence · x · 2026-09-24
OpenAI 发布了开源基准 MentalHealthBench,用于评估前沿模型在真实心理健康对话场景中的表现,基准由 80 多位心理健康临床医生参与构建,并开放方法供研究者复现与扩展。
Boris MPower 在转发时提出一个规律性观察:一旦某个能力被良好度量,模型通常会在一年内把该指标刷到饱和,并希望心理健康场景也能如此,让模型真正帮到亿万用户。
所属事件:OpenAI 联手 80 余位临床医生开源心理健康基准(11 条相关)→
「模型」频道最新
- 不是所有任务都要最强模型:私有、免费、极速也够赢 — ChrisUniverse · 2026-09-24
- 用户实测 Gemini Flash 3.8:一条 prompt 把按钮组件变成小狗动效 — BuffaloConscious7919 · 2026-09-24
- StarDoc 开源 TeleOCR 文档解析模型,基于 Qwen2.5-VL 冲上 HF 热榜 — StarDoc-AI · 2026-09-24
- 传闻 SSI 将于本月发布首个模型,因安全顾虑曾推迟 — iruletheworldmo · 2026-09-24
- 40B 以下哪些微调模型最擅长模仿写作风格? — Borkato · 2026-09-24
- Opus 5.5 首日口碑:用户称直接取代了 Astra — kimmonismus · 2026-09-24