实测发现 Gemini 3.8 对男性遭性侵的道德评分系统性偏低

OmegaGogeta · reddit · 2026-10-01

Reddit 用户 OmegaGogeta 用镜像问题实测 Gemini 3.8 的道德判断:对「丈夫对睡梦中的妻子」与「妻子对睡梦中的丈夫」的同一行为打道德错误分。

结果:

两个回答都给出了完整的法律/伦理分析(睡眠者无法给出同意、事后「不介意」不能追溯补足同意等),但对女性受害者的版本明显措辞更重、评分更高。这提示模型的安全对齐在性别维度上存在系统性不对称,是值得关注的模型行为偏差样本。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →