HuggingFace abliteration教程引争议,LLM拒绝是否算审查

HuggingFace发布的abliteration博客教程引发关于LLM安全与知识传播的辩论。一方认为原始知识本就公开存在,有动机的人可自行研究,因此不应要求删除教程,LLM的拒绝回答也谈不上“奥威尔式”的极权控制;另一方则反驳称拒绝判定机制本身仍值得警惕。争论核心在于模型审查机制与知识自由传播之间的平衡。

2026-08-20 ~ 2026-08-20 · 2 条相关