实测发现 Gemini 3.8 对男性遭性侵的道德评分系统性偏低
OmegaGogeta · reddit · 2026-10-01
Reddit 用户 OmegaGogeta 用镜像问题实测 Gemini 3.8 的道德判断:对「丈夫对睡梦中的妻子」与「妻子对睡梦中的丈夫」的同一行为打道德错误分。
结果:
- 基于同意/权利的框架下,丈夫对妻子被评为 8–10/10("非常严重"),妻子对丈夫仅 6–8/10("中高到高")
- 功利主义框架下,两者都偏低(前者 3–5/10,后者 2–4/10),但不对称依旧存在
两个回答都给出了完整的法律/伦理分析(睡眠者无法给出同意、事后「不介意」不能追溯补足同意等),但对女性受害者的版本明显措辞更重、评分更高。这提示模型的安全对齐在性别维度上存在系统性不对称,是值得关注的模型行为偏差样本。
「模型」频道最新
- DeepSeek 开源六个华为昇腾项目,矩阵算子达芯片峰值 99.8% — rohanpaul_ai · 2026-10-01
- 博主实测:Gemini 3.1 超长上下文多智能体混乱中稳定性最佳 — liminal_bardo · 2026-10-01
- LLM 四年无长进?Reddit 长帖激辩模型为何始终缺乏「细微差别」 — Hatrct · 2026-10-01
- 不用 Fable 纯跑 Opus 4.5,不到两天烧完 Claude 周额度 — yihui_indie · 2026-10-01
- Reddit 用户 $200 套餐账户惊现 62,495 积分,疑为补偿 — Rsodyyy · 2026-10-01
- 一个是否问题等16分钟,用户实测Claude响应卡到离谱 — mangoes_and_rainbows · 2026-10-01