测试发现 LLM 会自信解读纯噪声数据

Schema Labs 工程师与 Reddit 用户先后实验,向多个大模型提供由 rand() 生成的纯随机浮点数表格(20 列 5000 行,无任何真实结构),询问数据含义。结果所有模型都给出自信且言之凿凿的解释,如将其描述为传感器读数等。这一发现揭示 LLM 在面对无意义数据时缺乏怀疑能力,倾向于编造看似合理的分析。

2026-09-02 ~ 2026-09-02 · 2 条相关