Geodesic 主攻对齐预训练:让安全先验扛得住能力 RL 训练

tomekkorbak · x · 2026-09-16

英国剑桥 AI 安全研究组织 Geodesic Research 由 researcher tomekkorbak 介绍,致谢其 Geodes 团队并公开招聘。核心议程:对齐预训练(Alignment Pretraining)——在预训练与 midtraining 阶段就把对齐先验「烤」进基座模型,使其在后续长程能力 RL 中不被削弱。

关键信息:

作者称该方法是初步性的,更令他兴奋的大问题是:如何为 RL 塑造先验,以确保对齐的鲁棒泛化。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →