研究者解读 Anthropic 承诺:开放的不只是模型,还有训练流程本身

eliebakouch · x · 2026-09-13

eliebakouch 点评 Anthropic 向第三方评估者开放访问的承诺,认为其中一句比看起来分量重得多:第三方将能评估「不仅是训练完成的模型,还包括训练管线和流程本身」。

这意味着外界拿到的不是去掉安全护栏的模型访问权,而是能窥见模型是如何被训练的——对独立的对齐评估来说,这是更深一层的透明度。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →