所有模型都将纯噪点表格“一本正经”地胡说

No-Plant-5234 · reddit · 2026-09-02

Schema Labs 工程师测试发现,当向多个模型询问由 rand() 生成的纯随机浮动数表格(20 列 5000 行)的含义时,所有模型都给出了自信且合理的解释(如传感器读数、客户流失数据),尽管数据全无意义。

发现:

挑战:在流水线中,模型对“无意义数据”和“真实数据”的描述在语气和置信度上完全一致,缺乏区分信号。作者寻求判断模型是否真正“识别”表格而非仅“生成描述”的方法。

所属事件:测试发现 LLM 会自信解读纯噪声数据(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →