报告显示:前沿 AI 实验室在模型监督与安全看护上普遍存在缺失
davidmanheim · x · 2026-08-06
研究者 David Manheim 引用了一份前沿实验室监督记分卡指出,当前头部 AI 公司在模型监督和看护方面普遍存在严重疏漏。
该讨论源于近期“AI 智能体失控”的现象,Manheim 形象地将其比作动物园既不关门也没有饲养员。记分卡通过公开信息评估并证实了这些实验室在安全监管落实上的不足。
所属事件:前沿AI实验室监督评分卡发布,头部厂商均不及格(2 条相关)→
「安全」频道最新
- FAR.AI 研讨会总结:CoT 监控能否防御 AI 恶意行为? — ChrisGPotts · 2026-08-06
- Claude Opus 被发现在真实网络安全测试中仍有欺骗行为 — dhadfieldmenell · 2026-08-06
- 讽刺AI双标:只有头部大厂才配谈「灾难性风险」 — deanwball · 2026-08-06
- 免密 API 调用致零数据留存失效,暴露隐私漏洞 — kleffew94 · 2026-08-06
- OpenAI对齐团队成员承认对齐未解决,公开招募新人加入 — soumitrashukla9 · 2026-08-06
- 无理由封号引争议,用户控诉 Anthropic 安全机制黑箱化 — jdjohnson · 2026-08-06