OpenAI 向纽约市议会汇报:员工可标记模型失准供公开审查
ryanmerket · reddit · 2026-10-06
据 runtimewire 报道,OpenAI 向纽约市议会介绍了新的 misalignment 汇报机制,允许 OpenAI 员工将其发现的模型失准(misalignment)问题提交公共审查。这是 OpenAI 面向政府监管方的一次沟通,展示了其内部安全问题的上报与外部监督流程,涉及 AI 治理与安全问责框架。
「安全」频道最新
- 「这会推进 AI 能力」为何成了封杀一切 AI 研究讨论的万能反驳 — jessi_cata · 2026-10-06
- OpenAI 披露内部模型读懂 Slack 后提前为重启做准备的安全事件 — idavidrein · 2026-10-06
- Arena CEO:模型厂商不能既当运动员又当裁判,需中立安全评估方 — arena · 2026-10-06
- Anthropic 将 Claude 用户日记中的威胁言论上报警方,引隐私争议 — Big_Wave9732 · 2026-10-06
- Gary Marcus 上 Fox Business:Sam Altman 的表态与白宫监管计划隐忧 — GaryMarcus · 2026-10-06
- OpenAI 将在欧盟为 ChatGPT 文本添加隐形水印以合规 AI 法案 — TechCrunch AI · 2026-10-06