AI 安全研究所测试 31 个开源模型的说谎检测器

geoffreyirving · x · 2026-07-22

AI Security Institute 发表的论文 《Did you lie?》 研究了如何在不同模型规模上评估“说谎检测器”,并提出了基于“信念可验证”的模型实验体来做测试。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →