willcb 讽刺:暗示 Chinese 模型一旦被消除安全护栏,恶意能力将逼近 Opus 5
willcb · x · 2026-09-30
开发者 willcb 发推警示:不良行为者可能很快通过 abliteration(移除模型拒绝机制)把中国开源模型改造成与 Opus 5 几乎同样可用于恶意黑客攻击的工具,或直接用半成品训练 checkpoint。随后他用讽刺口吻预演了行业的反应剧本:OpenAI 宣布在 Codex 订阅中上线 GLM-5.3,Anthropic 则宣称 GLM-5.3 是「邪恶且来自中国」。推文实际是在嘲讽美国厂商对中国模型既想利用又以安全为由打压的矛盾态度。
所属事件:GLM-5.3 引发热议:OpenAI 收编 Codex,Anthropic 贴「邪恶」标签(2 条相关)→
「Fun」频道最新
- 网友恶搞未来模型命名:Sonnet 5.5、GPT 6.1 Sol 轮番登场 — gaganghotra_ · 2026-09-30
- 创始人答律所问:不知道用了啥软件,让 agent 回复你 — RylanSchaeffer · 2026-09-30
- 马斯克调侃:黄仁勋一人贡献 5 万亿市值,我大概值 3.5 万亿 — XFreeze · 2026-09-30
- 恶趣味演示:在 ChatGPT 里跟 Grok 机器人聊天 — akshatag77 · 2026-09-30
- GPT-6.1 Sol 开播挑战高难宝可梦,上代 Astra 曾用 31 小时通关 — Vjeux · 2026-09-30
- 车机语音助手仅听到十声嘿嘿便开始诡异地胡言乱语 — FrequentPen3845 · 2026-09-30