Reddit 争论称,Anthropic 的安全路线可能拖慢开放权重模型

UserXtheUnknown · reddit · 2026-07-28

这条 Reddit 讨论认为,Anthropic 推动的安全方案可能会比帮助用户更伤害开放权重模型。作者的核心观点是:这类方案并不能真正解决滥用问题,因为恶意行为者完全可以绕开安全控制,或者干脆不公开发布模型。

帖子进一步指出,开放权重模型在结构上更吃亏:安全约束往往必须直接写进模型本体,容易让模型“被削弱”;而闭源模型可以把安全检查放在外部过滤层,不必改动核心能力。作者因此认为,这类政策逻辑可能会拖慢 open weights 的发展,并提高企业和个人的使用门槛。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →