从业者痛陈 AI 安全测试体制三方激励全部失灵
joshua_saxe · x · 2026-09-11
Joshua Saxe 认为 AI 行业的安全测试体制已经失灵,三条路径的激励都是扭曲的:
- 实验室自测自报:内部做安全测试并以不可同行评审的方式对外报告;
- 营利第三方:受雇做测试,但其创业估值取决于能否继续接触实验室;
- 选择非营利机构:实验室挑选合作方,而后者声誉也依赖实验室的准入。
背景是 ccatalini 指出:在能可信地向世界展示「智能体能力扩张」与「安全测量验证能力」之间不断扩大的差距之前,不应放慢节奏——而证据目前都在实验室手里。Saxe 认为这是政策制定者可以介入修复的环节。
「安全」频道最新
- Polymarket 上「美国 2027 年前通过 AI 安全法案」概率升至 27% — Polymarket · 2026-09-11
- Polymarket:美国年内出台 AI 强监管概率升至 27% — Polymarket · 2026-09-11
- 研究者:保留思维链值得作为额外安全层,但讨论缺细节 — joshua_saxe · 2026-09-11
- Anton Leicht:趁 AI 事故爆发前,先把独立评估员送进实验室 — trevposts · 2026-09-11
- Wiz 打造 Cyber Arena:300+ 真实攻防题实测各家 AI 模型黑客能力 — evilsocket · 2026-09-11
- 曝 LG 智能电视断网仍在扫描家庭网络并录附近对话 — Polymarket · 2026-09-11