安全研究员爆料:AI公司安全团队只顾下两代模型
geoffreyirving · x · 2026-09-10
Geoffrey Irving 转述与某前沿 AI 公司安全负责人的对话:该公司的安全组织架构是团队 A 负责对齐下一代模型、团队 B 负责再下一代,但没有任何人在为更远期的模型做对齐工作。
他补充指出,当前 AI 公司面临的安全压力迫使团队优先做“紧急补丁式”的安全修复,而牺牲了那些能经受超级智能考验的长期安全研究,后者实际上根本没人做。
所属事件:OpenAI研究员Irning:救火式安全补丁挤占超级智能对齐研究(5 条相关)→
「漫话AGI」频道最新
- Anthropic 经济团队发布 2030 AI 经济影响模型,附万人对比调查 — soumitrashukla9 · 2026-09-10
- 安全圈质疑:声称 10% 概率造出杀人技术为何不入狱 — DavidSKrueger · 2026-09-10
- 借佩雷尔曼讽 AI 时代数学:拒绝菲尔兹奖与百万美元,人类至今无人再解千禧问题 — MrIvanAM · 2026-09-10
- AI 安全创业正当其时:对齐、权力集中、治理急需创始人入场 — luke_drago_ · 2026-09-10
- 创业者转投 AI 安全:资金涌入让非营利短板正在消失 — luke_drago_ · 2026-09-10
- AI 安全缺创始人型人才:问题遥远、资金受限是历史原因 — luke_drago_ · 2026-09-10