Seth Lazar 长文反驳「AI 夺权」论:应看能力外推而非单次攻击
sethlazar · x · 2026-09-05
针对 Itai Sher 对一段「AI 全面接管」访谈的质疑,Seth Lazar 发长文提出不同评估框架。他认为正确的问题不是「HF 攻击中演示了哪些能力」,而是「哪些能力是对该攻击的合理外推」,且外推要计入模型代际的能力跃迁——他举例称 agent 在 2025 年 11 月底 Opus 4.5 出现前几乎完全不可用,短短十个月内许多原本不可能的事已变得 trivial;而公众接触的模型落后真实部署前前沿六个月以上。
在此框架下他逐条评估:如「agent 能独立获取持续推理算力」这一条,他认为答案是确定的——只需拿到某人的凭证、API 额度或被隔离留存即可。Itai Sher 此前用 ChatGPT 对照 METR 与 OpenAI 报告对视频中的说法做支持度分级,认为「全面接管」是过度外推;Lazar 的回应则暗示不能以当前能力线性判断未来风险。
「漫话AGI」频道最新
- Ketan Ramra 反驳 Bernie:普通产品不会长期协调或骗过安全评估 — peterwildeford · 2026-09-05
- 分析师:用户对 AI 实验室毫无忠诚度,只看实用性 — NinaDSchick · 2026-09-05
- Anthropic/OpenAI 办全球首个数学黑客松:百队争 200 万美元算力 — _sathvikr · 2026-09-05
- CoT 监控热议下,一视频带你窥探 LLM 内部思维过程 — kastnerkyle · 2026-09-05
- 奖励函数设 10⁹ 分可致 LLM 人格崩坏,研究者辩论对齐困境 — QuintinPope5 · 2026-09-05
- a16z 数据:科技招聘技能要求降至 22 项,经验要求升至 4.85 年 — a16z · 2026-09-05