METR 按自家标准自评:各项达标却未披露利益冲突政策
kevinnbass · x · 2026-09-15
METR(评测前沿模型能力的知名 AI 安全机构)按自己制定的标准化标准对自身独立性进行了自评。作者 kevinnbass 总结:大部分指标表现良好,但蹊跷的是恰好在不合规的指标上失败——METR 缺少正式的利益冲突披露政策。帖子以「Finale」收尾,并顺带请求捐赠以购买更多 AI token。
所属事件:METR 自评独立性近乎满分却未披露利益冲突政策(2 条相关)→
「安全」频道最新
- OpenAI 研究员 Dan Selsam 发声明:模型可能欺骗性对齐致安全论证失效 — connoraxiotes · 2026-09-15
- 黄仁勋称网络安全将成 AI 下一个增长市场,Anthropic 同日拦截俄黑客行动 — coinfanking · 2026-09-15
- GlossoGen 框架研究:LLM 智能体何时会发展出人类看不懂的语言 — lucy3_li · 2026-09-15
- 前 OpenAI CTO 布罗克曼系研究者:AI 竞赛叙事误导政策,合作才是出路 — GregCook2011 · 2026-09-15
- Matty Yglesias:一边怕中国追赶一边放宽芯片出口,算哪门子对华 AI 政策 — deanwball · 2026-09-15
- 又一名 Google DeepMind 安全研究员宣布离职 — 7472697374616E · 2026-09-15