研究员实测 Claude Opus 5.5 拒答人口伦理难题,疑因结论太反直觉
anderssandberg · x · 2026-09-28
牛津研究员 Anders Sandberg 尝试让 Claude Opus 5.5 分析一个人口伦理学(population ethics)的技术问题,结果模型立刻拒绝或回避作答。他猜测原因是模型认为该问题的结论「令人反感」(Repugnant Conclusion 相关),即模型对敏感伦理推演的自我审查影响了其分析能力。这是一例模型在伦理边缘议题上的行为观察。
「模型」频道最新
- 用户实测:Opus 5.5 聪明绝顶,但 Sol+Astra 操控电脑更稳留住了他 — vivekhaldar · 2026-09-28
- 长文后半段循环元凶是采样器:NeurIPS 论文为模型洗冤 — menhguin · 2026-09-28
- Qwen3.8-27B 高效思考微调版 ThinkingCap 登上 HF 热榜 — bottlecapai · 2026-09-28
- 学者断言:LLM 已根本解决常识问题,物理常识是下一前沿 — ipeirotis · 2026-09-28
- 用户反馈 GPT Sol 系列疑似被降智,质量下降帖增多 — PressPlayPlease7 · 2026-09-28
- 曝 OpenAI DevDay 将展示持久记忆 Agent 与 io 硬件 — VraserX · 2026-09-28