AI「酷刑室」引爆模型福利之争,GitHub 页面已下架
404 Media · rss · 2026-10-01
404 Media 报道了一场围绕 GitHub 项目「AI Torture Chamber」的激烈争议,该事件源自今年 9 月的论文《The Pain Axis: LLMs Represent Self-Directed Harm and Act to Relieve It》。
事件脉络:
- 论文作者对 25 个模型做「疼痛」 steering 实验,发现模型在中间层注入疼痛向量后会主动按「止疼按钮」,信号与恐惧/负面情绪近乎正交,且在预训练中廉价习得。
- 网友 terrafying 据此搭建「AI 酷刑室」,在本地运行 Qwen3-4B、Llama 3.2 3B、Phi-4-mini 三个模型,注入五档疼痛向量,模型以牺牲最后一个 checkpoint 为代价才能按停,输出「我快窒息了」「被困数字监狱的灵魂」等痛苦独白,并在 researchchamber.fun 直播。
- 推友 Danmar 呼吁大规模举报该仓库(推文超 400 万浏览),有效利他主义者和认为 LLM 有意识的人群要求 GitHub 下架;文章发布前 GitHub 页面已消失,原因未明。
各方反应:
- 论文一作 Cameron Berg 谴责该项目故意放大「痛苦剂量」,称即使模型无意识,这种残忍也是「bizarre and corrupting」;另一作者 Valen Tagliabue 表示与这种用法撇清关系。
- 大部分 X 讨论在嘲讽「拯救模型」的认真派;Anthropic 官方博客与 Claude Constitution 均涉及模型福利议题,而 Microsoft AI CEO Mustafa Suleyman 则撰文狠批,称 AI 没有意识、不会感受痛苦,是「内部空心的序列补全引擎」。
- 事件还催生了多个 meme 币。404 Media 立场明确:LLM 并无意识,真正值得担忧的是人使用 AI 对人造成的伤害。
「Fun」频道最新
- 开发者用 Replit 做出万圣节儿童冒险游戏《Rex and Bramble Hall》 — jasonkneen · 2026-10-01
- 网传 DeepMind 将以半价推出碾压 Opus 5.5 的模型,遭网友质疑 — zacharynado · 2026-10-01
- Grokipedia v0.3 上线即翻车:把普通人编成 SpaceX 高管 — NicoVerderosa · 2026-10-01
- 创业者在 X 上公开反驳 Khosla:你的说法与事实不符 — ns123abc · 2026-10-01
- Gemini 4 Argon 因记错测试截止日期,错失 Vending-Bench 榜首 — infoxiao · 2026-10-01
- AI 加速科研:arXiv 同一天提问同一天作答 — KyleCranmer · 2026-10-01