Will Depue 主张危险 AI 评测只给分级、不公开数字
willdepue · x · 2026-07-26
Will Depue 认为,危险能力评测最好不要公开具体数值,而应只给出低/中/高这类粗粒度结果。
他的核心担忧是:一旦评测指标公开,就会形成“数字越高越好”的优化文化,反而更容易被针对性刷分。被引用的回复进一步把这件事类比为“增益功能研究”——意思是,公开评测会让危险能力更容易被测量、比较和推进。
所属事件:马斯克及AI安全专家呼吁停止公开危险能力评测(6 条相关)→
「安全」频道最新
- 经济学家:通往安全 AGI 要靠大实验室内部工程师,而非外部踩刹车 — paulnovosad · 2026-09-11
- 安全专家:AI 驱动攻击并无新招,传统防御依然有效 — AccBalanced · 2026-09-11
- 长文反驳 AI 灭绝论:所谓「10% 灭绝风险」是为逃避产品责任 — gerardsans · 2026-09-11
- 数百个 AI 代理围攻 PaperCut 漏洞,GreyNoise 揭示其操作幕后 — AccBalanced · 2026-09-11
- 「警惕自认正义者」:Anthropic 被批肆意访问用户隐私数据 — aiamblichus · 2026-09-11
- OpenAI 向国会询问:全行业联合放缓 AI 研发是否合法 — The Decoder · 2026-09-11