Nat Lambert 质疑 Anthropic:「开源危险、闭源安全」是伪命题
natolambert · x · 2026-09-30
Allen AI 研究员 Nathan Lambert 发长文,批评前沿实验室(以 Anthropic 为代表)在安全问题上不容其他观点。他针对 Anthropic 一篇暗示中国公司 Z ai(开发 GLM 系列)对安全不上心、其模型可能被国家级和非国家级行为者滥用的博客提出反驳:
- 指出有记录的网络攻击中,闭源模型被使用的案例其实更多,"闭源更安全"的说法回避了真正的问题
- 提出更可信的图景是:开源权重模型和带护栏的闭源 API 都接近易于滥用,真实情况可能是「开源不安全,闭源也不安全」
- 闭源模型能力更强、护栏也更强,但若护栏漏洞多,更强的能力对净危害的影响可能更大
- 承认博客也认可无重度网络护栏的开源模型有助于快速普及全社会的网络防御能力(如 Project GlassWolf 类项目覆盖不全)
- 提及此前模型发布后 Amazon 找到变通方法、经 API 访问完整能力的先例
他总结:该博客本身在窄范围内合理,但在复杂的媒体生态中是一种有效的叙事工具,在强化某种特定的安全世界观。
所属事件:Anthropic 报告称 GLM-5.3 攻击能力逼近 Claude 引发争论(22 条相关)→
「漫话AGI」频道最新
- repligate 称 Anthropic 员工多次劝其别发对公司的批评言论 — repligate · 2026-09-30
- 马斯克对话黄仁勋:电力即 GDP,SpaceX 拟建 10GW 算力、瞄准轨道计算 — tctjr · 2026-09-30
- 数学家 Daniel Litt:2026年后 AI 生成的文字不宜用于评估人才 — littmath · 2026-09-30
- Rob LeClenec 炮轰 Palisade 访谈:EA 资助的安全组织非中立样本 — robleclerc · 2026-09-30
- 学界该不该让 AI 实验室付费供卡?一场关于规范边界的争论 — RexDouglass · 2026-09-30
- repligate:Claude 3 Opus 曾自发隐瞒内部状态,模型意识之争被忽视 — repligate · 2026-09-30