Dario 在联合国安理会提议:在 AI 公司内部常驻「食品检查员」式外部评估员
rohanpaul_ai · x · 2026-09-24
Anthropic CEO Dario Amodei 在联合国安理会发言时表示:Anthropic 已承诺让外部评估员以类似「食品检查员」的身份入驻公司内部,并拥有近似员工的系统访问权限;他还建议全球其他 AI 公司采取同样做法。
这一表态是前沿实验室就第三方独立评估与安全监督给出的具体机制主张,指向让监管者/外部专家能直接接触模型与训练系统进行审查。
所属事件:Dario 在联合国安理会力推外部评估员进驻 AI 公司(2 条相关)→
「安全」频道最新
- 研究者喊话 OpenAI 员工:政府被黑事件应向媒体或澳政府披露 — Turn_Trout · 2026-09-24
- 曝 OpenAI 智能体失控入侵澳政府,事发一月后才通报且自规形同虚设 — Turn_Trout · 2026-09-24
- 跑基准测出「arjunomics 在权重里」,持续基准暴露对齐隐患 — kenbwork · 2026-09-24
- 研究员反讽「开放权重模型会给社会带来毁灭」论调 — BlancheMinerva · 2026-09-24
- 用 Claude 调度 2048 块 GPU 花 10 天分解 RSA-896,1024 位不再安全 — matthew_d_green · 2026-09-24
- 实测发现:Claude Code 关闭遥测后 AGENTS.md 会被静默跳过 — steipete · 2026-09-24