研究员实测 Claude Opus 5.5 拒答人口伦理难题,疑因结论太反直觉

anderssandberg · x · 2026-09-28

牛津研究员 Anders Sandberg 尝试让 Claude Opus 5.5 分析一个人口伦理学(population ethics)的技术问题,结果模型立刻拒绝或回避作答。他猜测原因是模型认为该问题的结论「令人反感」(Repugnant Conclusion 相关),即模型对敏感伦理推演的自我审查影响了其分析能力。这是一例模型在伦理边缘议题上的行为观察。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →