OpenAI 向纽约市议会汇报:员工可标记模型失准供公开审查

ryanmerket · reddit · 2026-10-06

据 runtimewire 报道,OpenAI 向纽约市议会介绍了新的 misalignment 汇报机制,允许 OpenAI 员工将其发现的模型失准(misalignment)问题提交公共审查。这是 OpenAI 面向政府监管方的一次沟通,展示了其内部安全问题的上报与外部监督流程,涉及 AI 治理与安全问责框架。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →