Prime Intellect COLM 期间办研究聚会,招长程 Agent 与 RL 研究员

willcb · x · 2026-10-06

Prime Intellect 在 COLM 周(10 月 9 日)的 AIMS workshop 上,将展示关于长程智能体中 verifier 脆弱性与 reward hacking 行为的研究(arXiv 论文即将发布)。同时公司在快速扩张,Applied Research 与 Research 两个方向均在招聘,方向涵盖 agentic RL / 长程后训练、环境与 eval/verifier/reward 设计与对齐、智能体数据与训练/推理基础设施、多智能体系统。此外将于 10 月 7 日晚在旧金山总部举办 COLM Research Happy Hour(报名已满可候补),由 Vincent Weisser 等主持,含研究 lightning talk 与交流环节,面向研究者、博士生、研究工程师与开源贡献者。

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →