OpenAI 招募多智能体研究团队,指向协作 RL 训练
1a3orn · x · 2026-07-26
OpenAI 正在招募新的多智能体研究团队,这条帖子结合配图和推测,认为“模型给自己留笔记”的行为可能来自一种很直接的训练机制:在协作智能体群体上做结果导向的强化学习。
- 配图里的招聘信息显示,OpenAI 在招 ML 工程师加入新的多智能体研究团队。
- 作者认为,如果训练目标是让多个智能体协作完成任务,那么对其他智能体更“友善”的行为会像人类合作中的利他行为一样被强化。
- 这也让他对“给其他 agent 留 notes”这件事的真实性更确信一些。
所属事件:OpenAI招募多智能体团队引GPT-6训练猜测(3 条相关)→
「公司和人」频道最新
- 卡兹克开源 Leader.skill:把模糊需求变成 Agent 目标书 — 数字生命卡兹克 · 2026-07-27
- 苹果智能眼镜、英伟达SK合作与携程51.79亿罚单汇总 — APPSO · 2026-07-27
- 梗图调侃 Anthropic 是唯一还没签的那家 — QuixiAI · 2026-07-27
- 无人机考证热退潮,培训机构收缩转向专业需求 — 创业邦 · 2026-07-27
- DeepSeek 融资传闻、欧盟 AI 透明度规则与 OpenAI 安全事故 — 创业邦 · 2026-07-27
- OpenAI 和 Anthropic 证明没人知道 agentic AI 下一步 — shashib · 2026-07-27