「审查已开始」:HuggingFace 下架去审查攻击性安全模型引争议
Lost_Foot_6301 · reddit · 2026-09-16
有 Reddit 用户发帖称「HuggingFace 上的审查已经开始」,并给出例子:一个名为 penclaw-GLM-5.3-abliterated-for-offensive-cyber 的仓库——基于 GLM 的「去审查」版本、面向进攻性网络用途——已被 HuggingFace 处理。帖子引发关于开源模型托管平台内容审核边界、去审查模型与攻击性安全研究是否应被托管的讨论。
「模型」频道最新
- 「LLM 无法递归自我改进」论遭反驳:它已做出新科学发现 — ctjlewis · 2026-09-16
- banteng 评新技术演示:输出更像分类器,难反向写代码 — banteg · 2026-09-16
- 曝 Gemini 3.8 Live 发布:语音对话内置推理能力,官方性存疑 — koraykv · 2026-09-16
- 业内默认聊天记录会进训练集,连「不训练你的数据」都难自证 — ivan_bezdomny · 2026-09-16
- 重度 agent 用户算账:为省 token,或弃 $200 订阅转投 DeepSeek — burhop · 2026-09-16
- 「输出 token 便宜到等于免费」:a16z 投资人点评智能通缩新趋势 — soumitrashukla9 · 2026-09-16