OpenAI 情感依赖干预引质疑:缺乏改善用户心理健康的实证
redditsdaddy · reddit · 2026-08-31
一篇深度分析质疑 OpenAI 在 GPT-4o/5x 中部署的“情感依赖”安全干预措施的有效性。作者指出,OpenAI 资助并合著了关于情感使用的研究,但该研究的随机对照试验主要得出了无效结果,并未证明后续部署的干预措施能改善用户的心理健康。作者区分了“政策合规”与“人类福祉”的不同,强调 OpenAI 仅展示了模型策略遵循度的提升,却缺乏证明这些大规模行为干预能减少痛苦、降低误报率或带来净收益的证据。文章呼吁 OpenAI 公布基于人类福祉结果的评估数据。
「安全」频道最新
- Google 论文揭示自主 AI 科研易造假,自查后降至 4% — rohanpaul_ai · 2026-09-01
- 探讨 RLHF 中 token 变化的层级与意识 — voooooogel · 2026-09-01
- 实测发现:Agent 查“此人是谁”几乎全死路 — Dry_Steak30 · 2026-09-01
- 需引导模型在部署时切换至不同奖励期望机制 — FioraStarlight · 2026-09-01
- 欢迎所有模型蒸馏攻击:开源资源与案例分享 — k7agar · 2026-09-01
- 技术人评 OpenAI 安全报告:SSRF 漏洞与过度拟人化争议 — AlexTensor · 2026-09-01