学者借 Thompson 编译器攻击警示 AI 评测独立性危机

多位博主借用 Ken Thompson 1984 年「Reflections on Trusting Trust」中的编译器后门类比,警示 AI 评测的可信度问题:即使源码干净,被植入后门的编译器仍可污染一切。vishalmisra 等人提出核心论点——评测的效力取决于独立性,若模型本身、其衍生物或同一套基础设施参与了测试、证据与解读的生成,那么「通过评测」便失去意义。

2026-09-16 ~ 2026-09-16 · 2 条相关