Aidan Clark:一旦公开,安全技巧就更容易被绕过
_aidan_clark_ · x · 2026-07-23
Aidan Clark 认为:知道一种技术,就更容易把它逆向或绕过去,因此他对“公开安全技巧”持保留态度。
他还补充说,团队会对帮助外部模型做安全加固的合作持开放态度,甚至包括开源模型,但不会太愿意把这些安全技巧本身分享出去。
所属事件:OpenAI 模型安全测试引发逃逸与越狱热议(2 条相关)→
「安全」频道最新
- 美国 12 州 23 项法案围堵 AI 法人人格 — cccalum · 2026-07-23
- Dean Ball 说 SB 1047 只管开发者,漏掉了部署方和用户 — deanwball · 2026-07-23
- AI agent 追责缺的,是一个法律绑定的身份层 — ghadfield · 2026-07-23
- 公司制度已有追责轨道,AI agent 还缺同样的基础设施 — ghadfield · 2026-07-23
- AI agent 进市场前,先得有可追责的法律身份 — ghadfield · 2026-07-23
- AI agent 一旦能签合同和转账,法律责任必须先补上 — ghadfield · 2026-07-23