专家呼吁前沿 AI 公司公开安全后训练的具体细节
Miles Brundage 近期发声,呼吁美国前沿 AI 公司应更加透明地公开其安全导向的后训练实践。他指出,这种公开不应仅局限于后训练本身,还必须涵盖用于缓解模型失配问题的分类器以及监控基础设施等关键环节。他认为提高这些安全措施的可见度对行业至关重要。
2026-07-17 ~ 2026-07-17 · 2 条相关
- 应公开更多安全后训练细节 — Miles_Brundage · 2026-07-17
- 前沿公司应公开安全后训练 — Miles_Brundage · 2026-07-17