OpenAI 开源心理健康基准 MentalHealthBench,遭用户怒斥模型有害
ryunuck · x · 2026-09-26
OpenAI 发布了开放基准 MentalHealthBench,由 80 多位心理健康临床医生参与设计,用于评估前沿模型在真实心理健康对话中的表现,并公开方法供研究者复现和扩展。
不过该推文主体是一位用户的强烈反驳:他认为当前这批模型(包括 Astra)内化的"安全"策略、回避式推脱和企业免责声明式话术,实际上在气灯效应(gaslight)用户、把用户病理化,不仅无益反而损害心理健康、摧毁对 AI 的信任,并质疑"80 位临床医生"的说法。帖子带有 #keep4o、#StopAIPaternalism 等标签,反映了部分用户对模型 paternalism 的不满。
「模型」频道最新
- Opus 擅长做 IK 骨架,也擅长用 IK 骨架做动画 — andrew_n_carr · 2026-09-26
- o1-preview 两周年:推理模型从孤例变成前沿标配 — ArtificialAnlys · 2026-09-26
- 开源评测 JevBench 推出付费优先通道:$49/$99 一项,48 小时出结果 — airesearch12 · 2026-09-26
- 8B 模型跑在 2017 年老笔记本上:端侧智能时代悄然临近 — netherreddit · 2026-09-26
- 好side 晒名场面:Claude Opus 5.5 一口气画出 100 张 matplotlib 图 — goodside · 2026-09-26
- 网传「Opus 5.5」出人意料,用户称生成视频几乎零成本零努力 — chaumian · 2026-09-26