Anthropic 与 OpenAI 拟引入内部安全评估员,独立性能否保证?
TechCrunch AI · rss · 2026-09-17
Anthropic 和 OpenAI 都计划在自家实验室内部嵌入独立安全评估员,让外部研究人员以前所未有的权限审查模型安全。研究者们欢迎这种开放程度,但警告指出:有意义的监督还需要透明度、真正的独立性,以及最终的监管介入,仅靠实验室自愿安排并不足够。
「公司和人」频道最新
- Databricks 全员换装 GPT-6 Astra:长程复杂任务碾压 Opus 5 — nickbaumann_ · 2026-09-17
- Runway 招入 HCI 研究者,押注 AI 视频与世界模型 — c_valenzuelab · 2026-09-17
- 选实验室先看人:AI 圈盛行「agent 干活、人社交」文化 — joannejang · 2026-09-17
- OpenAI 频繁暗示千禧年难题取得进展,或于 9 月 29 日 DevDay 公布 — haider1 · 2026-09-17
- 前 Waymo CFO Elisa de Martel 跳槽自动驾驶创企 Wayve — alexgkendall · 2026-09-17
- Sentry 拟为 AI 项目 Junior 招全职,要求有 agent 与开发工具经验 — zeeg · 2026-09-17