OpenAI 前安全负责人:每周二都在上线新能力与新风险
sourdub · reddit · 2026-10-08
OpenAI 前安全负责人 David Robinson 在 Ezra Klein 的播客中警告,推理更新、新工具和编码 agent 正让 OpenAI「每周二都在发布新能力与新风险」。
核心论点:
- 过去新一代模型始于大规模预训练,之后才有后训练与安全测试;GPT-4 完成后 OpenAI 还专门强调投入了「数月」安全工作。
- 如今基础模型只是发布物的其中一层:预训练是「烤蛋糕底」,而推理训练等后训练步骤可以快速重做,不必从头训练就能叠加更强的推理配方。
- 发布间隔急剧缩短:GPT-6.1 Sol 在 GPT-6 Sol 发布仅一周后就于 DevDay 亮相。
- 「这已经不只是聊天了」——接入模型的工具与能力扩展无需重新训练就能改变模型能做什么和风险是什么。
他的结论是:安全评估的节奏没有跟上发布节奏,风险正在以周为单位累积。
所属事件:OpenAI 前安全负责人警告每周都在上线新能力与新风险(2 条相关)→
「公司和人」频道最新
- a16z 榜单:Replit 消费 AI 支出前十、流量倒数,CEO 称用户多在做生意 — amasad · 2026-10-08
- AI 架构师 vs AI 工程师:企业落地最易混淆的分工 — DavidLinthicum · 2026-10-08
- 多模态推理创企 Nunchux AI 招人:宣称成本降百倍 — junyanz89 · 2026-10-08
- 《低俗小说》编剧力挺 AI 电影,Mary Sue 招募分销商 — gen_ericai · 2026-10-08
- humans& 团队将在 COLM 办线下见面会,多个方向仍在招人 — ericzelikman · 2026-10-08
- MTS 直播:OpenAI 722 份数学手稿、国家算力网等议题 — ajratner · 2026-10-08