新论文提出预训练对齐法:给 LLM 戴上“事实滤镜”

ctjlewis · x · 2026-08-02

大模型往往会盲目相信训练数据中的内容。一项新研究提出了一种“预训练对齐”技术,相当于给模型戴上“滤镜”,使其能够在包含错误或未对齐数据的训练过程中,稳健地区分事实与虚构。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →