halvarflake回应:找不受实验室影响的安全研究员有多难
halvarflake · x · 2026-09-14
安全研究资深人士 halvarflake 在与 Joshua Saxe 的争论中回应称,要求安全评估机构完全「独立」并未考虑现实权衡:既深度理解 LLM、又能做 AI 安全工作、还有资金支持、同时与各大实验室社交距离足够远的人,几乎找不到。这条争论的语境是 METR 等机构作为第三方评估方的独立性与科学性。
所属事件:Anthropic 慢化倡议引争议:METR 被指独立性不足(31 条相关)→
「安全」频道最新
- Dario 发文呼吁放慢 AI 前沿步伐,Anthropic 承诺开放第三方安全评估 — ZeroStateReflex · 2026-09-14
- 英王查尔斯三世将召集 Nvidia、OpenAI 等巨头讨论放缓 AI — Polymarket · 2026-09-14
- 研究指出:0.003% 票数变动即可改写 LMArena 榜首 — rishabh16_ · 2026-09-14
- Anthropic-HH 数据集:6.5% 标注者贡献一半偏好投票 — rishabh16_ · 2026-09-14
- AI 安全派与反垄断派激烈交锋,前 FTC 专员质疑 CEO 们求豁免 — AndyMasley · 2026-09-14
- 博主梳理 Anthropic 早期失齐论文:弱模型的恶意涌现早有伏笔 — eigenron · 2026-09-14