测试大模型逻辑推理:默认假设与偏见暴露无遗

LeonidasTMT · reddit · 2026-08-10

一位 Reddit 网友用一道来自 Instagram 的题目测试了多款主流大模型,发现它们普遍存在过度脑补和偏见问题。

模型们倾向于“字里行间自行脑补”、填补未声明的假设,或者直接照搬类似场景下的大众共识。作者指出,目前测试的模型中,没有一款能基于“无明确时间限制”选出选项 4,也没有模型因为“未声明免费”而拒绝选项 1,更没有注意到选项 2 依然意味着需要“工作”。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →