MoralityBench 榜单:AI 的道德判断跨次运行波动大,并非确定性输出

NakedPlato · reddit · 2026-10-05

新上线的 MoralityBench.ai 把道德心理学测试改编成 AI 基准,生成一个「AI 道德排行榜」。发布者指出一个有趣的发现:除 Jev 外,各模型在多次运行中对同一道德问题的回答存在明显方差——道德判断似乎不是确定性的。站点已公开榜单,配图展示了各模型的对比结果。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →