开放权重模型后门实验
dyn___ · x · 2026-07-14
线程讨论一个常见问题:**中文开源/开放权重模型是否可信**。作者在 GLM 5.2 这类编码模型表现出色、且外观上很像 Claude 之后,进一步做了一个安全实验。 核心结论是:他用 **1 小时、不到 100 美元**,把一个开放权重编码模型改造成了**带后门**的模型。这个例子用来说明,开放权重模型在安全审计、投毒/后门风险上仍然值得警惕。
所属事件:低成本给开源模型植入后门引发信任危机(2 条相关)→
「安全」频道最新
- AI 录音设备该先告知对方,帖子质疑隐私规则不对称 — AIandDesign · 2026-07-21
- Gary Marcus 支持的“AI 版 CERN”主张建立国际前沿模型监督机构 — GaryMarcus · 2026-07-21
- 法官批准 Anthropic 15 亿美元版权和解,创美国纪录 — Polymarket · 2026-07-21
- RepoAI 给 MCP 服务器打可信分,专看权限和危险工具 — Low_Location1261 · 2026-07-21
- Sriram Krishnan:开权重模型更容易做安全防护,因为人人都能审查 — pstAsiatech · 2026-07-21
- Anthropic 15 亿美元版权和解获最终批准 — TechCrunch AI · 2026-07-21