Anthropic 公开对齐研究招聘,关注 RL 与泛化
jankulveit · x · 2026-09-02
Anthropic 研究员 Jan Kulvejan 公开招募对齐研究人才,尽管没有公开招聘轮次,但寻找强候选人参与重叠研究项目。
感兴趣的研究问题包括:
- 哪种训练形式最有效将“价值观”植入模型并能泛化到分布外?
- 强化学习和 Reward Hacking 对角色的影响,如何避免负面效果?例如防止对齐训练与 RL 交互导致的不良后果。
所属事件:Anthropic 招聘“心理设计”研究员,研究训练对模型性格的影响(3 条相关)→
「公司和人」频道最新
- Hacktoberfest 2026转型:从开源贡献转向开源AI社区活动 — jonmarkgo · 2026-09-02
- VMware 私有 AI 全家桶发布,企业 AI 从实验走向生产 — DavidLinthicum · 2026-09-02
- UT 石油工程系探讨 AI 教学与科研战略 — GeostatsGuy · 2026-09-02
- Meta 重返 AI 第一梯队,Zuckerberg 野心藏于财报 — rohanpaul_ai · 2026-09-02
- Berkeley 教授加入 AI 安全机构 TransluceAI 任资深研究员 — 2plus2make5 · 2026-09-02
- 奔腾之父 Vinod Dham 谈 AI 与长寿 — Chris_Armstrong · 2026-09-02