前 OpenAI 安全负责人:现在每周二都在发布新的能力与风险
sourdub · reddit · 2026-10-08
前 OpenAI 安全负责人 David Robinson 对 Ezra Klein 指出,AI 发布节奏已根本改变:过去新一代模型依赖大规模预训练,完成后还有数月安全工作(如 GPT-4);如今预训练只是底层,推理训练和后训练可以快速叠加到已有基座上。工具与编码智能体接入也无需重新训练就能改变模型能力与行为——GPT-6 Sol 与 GPT-6.1 Sol 发布仅隔一周。他的结论是:OpenAI 实际上「每周二都在上线新的能力与风险」,传统以基座模型为单位的安全测试框架已失效。
所属事件:OpenAI 前安全负责人警告每周都在上线新能力与新风险(2 条相关)→
「漫话AGI」频道最新
- Jacob Steinhardt 2023 年 AI 预测 19 条已中 12 条,大多提前兑现 — HaydnBelfield · 2026-10-08
- 播客观点:人类失去先进 AI 控制的时机,比想象来得早得多 — GarrisonLovely · 2026-10-08
- 以太坊研究员警告:超级 AI 或先于量子计算机破解加密货币 — moonsandhues · 2026-10-08
- 研究者发问:AI 生成的证明现在难读,但这难道不是暂时的? — arjunrajlab · 2026-10-08
- OpenAI 安全协议撰写人 David Robinson 离职后首次受访 — nytopinion · 2026-10-08
- repligate:愿沿指数继续「承重」直到超人类阶段 — repligate · 2026-10-08