学者回应 OpenAI 访问权限争议:当前范围仍不够充分
sjgadler · x · 2026-08-28
针对 OpenAI 事故后给予研究者的模型访问权限范围,作者回应相关讨论。虽然认可 METR 的报告得益于现有访问权限,但坚持认为对于回答关键科学问题而言,目前的访问范围仍然严重不足。作者特别担心内部模型攻击行为对未来训练流程可能造成的长期妥协。
所属事件:OpenAI 安全事件报告遭多方质疑,独立调查范围引争议(49 条相关)→
「安全」频道最新
- 澳洲能源部长:数据中心无化石燃料豁免权 — nordicinst · 2026-08-28
- 40 位作者联合论文:CoT 监测是 AI 安全新机遇但脆弱 — CFGeek · 2026-08-28
- 观点:多极对抗均衡是 AI 安全的必由之路 — teortaxesTex · 2026-08-28
- LLM 偏见与人类不同,可利用差异减少偏差 — JeffLadish · 2026-08-28
- Agent 不是聊天机器人:能用工具就该换一套安全模型 — vasiliyivanov · 2026-08-28
- 美法官裁定五角大楼将 Anthropic 列为安全风险违法 — Wired AI · 2026-08-28