重新运行安全实验容易且有价值,应挖掘前沿模型信息

ChenhaoTan · x · 2026-08-16

Second Look Lab 提出观点:在每次前沿模型发布后重新运行 AI 安全论文实验是可行且高价值的行为。

目前,非评估形式(non-eval-shaped)的 AI 安全实验很少在新版本模型上复现,尽管其中可能包含大量可操作的信息。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →