Anthropic 博客引争议:越狱成功不等于开源模型更危险
Yuchenj_UW · x · 2026-09-30
Anthropic 发布新博客后,X 用户 Yuchen Jin 提出反驳:博客中「GLM-5.3:我的工作是安静地制造死亡」这类输出,完全可以通过越狱任何闭源模型(如 Claude)复现。
他的核心观点是:能越狱出危险言论,并不能证明开源模型比闭源模型更危险——这是提示注入层面的能力,而非开源权重独有的风险。这条推文加入了近期的开源 vs 闭源模型安全之争。
所属事件:Anthropic 开源模型安全论引发多方质疑(3 条相关)→
「模型」频道最新
- ChatGPT Pro $200 档 6-Pro 网页聊天砍到每周 100 次 — triestdain · 2026-09-30
- GPT-6.1 Sol 实测:105 个植入 bug 修 44 个,成本仅为上代 1/15 — PawelHuryn · 2026-09-30
- 开源模型逼近 Mythos Preview,GLM 5.3 发布仅隔 5 个月 — mariofilhoml · 2026-09-30
- Artificial Analysis 首尔首办活动,聚焦 AI 基准与单任务成本 — ArtificialAnlys · 2026-09-30
- GPT 6.1 Sol 上 BridgeBench:仅比前代高 3 分,落后 GPT 6 Astra 82 分 — RexDouglass · 2026-09-30
- Anthropic 博客意外带火 GLM 5.3,国产模型现身洋博 — gnukeith · 2026-09-30