Anthropic 报告批 GLM-5.3 开源不安全,被指借安全之名兜售闭源模型
oran_ge · x · 2026-09-30
在 OpenAI 宣布企业套餐加入 GLM 5.3 等开源模型后,Anthropic(A\)随即发布报告批评开源模型安全问题,引发广泛质疑。
报告要点:
- 称 GLM-5.3 是「迄今网络安全能力最强的开源模型」,与美国前沿模型相差约 4 个月。
- 在对比 Opus 4.6、Kimi K3、DeepSeek Flash 等模型的测试中,GLM 5.3 是唯一具备漏洞利用能力的模型。
- 指出开源模型可通过 abliteration(拒绝行为削减)技术重训练出移除安全护栏的版本,成本约 4400 美元,并据此论证「开源模型天然不安全」。
- 对原版带护栏的 GLM 5.3,也可通过欺骗性提示词、预填充思考等方式绕过;而 Claude 不提供预填充思考且不开源,故「安全」。
- 结论呼吁企业尽快采用安全的闭源模型。
发帖人质疑:报告实为借安全之名自我兜售——给开源模型去掉护栏再证明其不安全,论证方式站不住脚;真关心开源安全大可参与建设,而非一边封号一边占道德高地。报告讨论安全是表象,推销闭源模型才是实质。
所属事件:Anthropic 报告称 GLM-5.3 网络攻击能力逼近 Claude,开源扩散引争议(31 条相关)→
「模型」频道最新
- ChatGPT Pro 订阅被曝附赠 6.25 万 Codex 额度,年底过期 — chaumian · 2026-09-30
- 用户算账:62500 积分仅值约 2500 美元 GPT-6.1 API 用量,额度大缩水 — chaumian · 2026-09-30
- 有 Pro 订阅用户称账户突然到账 62500 额度,约为月度 15 倍 — IronDarbe · 2026-09-30
- 用户质疑:ChatGPT 经典聊天模式为何拿不到最新 GPT 模型 — koltregaskes · 2026-09-30
- 用户账号到账 62500 积分,名义价值约 2500 美元 — kimmonismus · 2026-09-30
- BAAI 开源 27B 长程 Agent 模型 AREX-2,上下文达 262K — Skyline34rGt · 2026-09-30