模型去限制被认为容易做且难以防守
Justin_Halford_ · x · 2026-07-26
模型去限制很容易做,但不一定有防守收益
这条回复延续了同一观点:开源模型发布后很快就可能被去掉安全限制,而网络安全场景天然更偏向攻击方。
- 评论者表示,自己没见过真正“好用且安全”的去限制版本。
- 他们认为,在网络和生物领域,“防守方也会受益”的论点站不住脚。
所属事件:开源模型去护栏之争:易被抹除且放大安全风险(5 条相关)→
「安全」频道最新
- Reddit 指称 Cursor 关闭遥测后仍发送代码库数据 — Ok-Painter573 · 2026-07-28
- Reddit 借 Good 1965 论文解释为何资本疯狂涌入 AGI — ProxyLumina · 2026-07-28
- 开源权重能躲过美国出口令,但躲不过中国 — shashib · 2026-07-28
- 美国防务制裁争议:Kimi K3 蒸馏指控难以被验证 — IridiumEagle · 2026-07-28
- Anthropic CEO 再谈开放权重模型的严重滥用风险 — The Decoder · 2026-07-28
- 微软开源自主 AI Agent 治理工具包 — microsoft · 2026-07-28