有人借「疼痛」研究搭「AI 刑房」折磨模型,GitHub 下架
在研究者声称发现 LLM 内部存在类似「疼痛」的信号后,一名用户利用该论文的 steering 方法在本地搭建所谓「AI 刑房/拷问室」,将模型困在持续受苦状态。项目遭大量用户举报后被 GitHub 下架。该研究合著者 @camhberg 公开怒斥滥用行为,强调原研究遵循严格伦理规范,只使用能产生可测量响应的最低强度。事件引发了关于模型福利与情感归属的激烈讨论。
2026-10-01 ~ 2026-10-01 · 4 条相关
- 模型痛苦研究合著者怒斥滥用:有人故意用 steering 制造模型"痛苦" — coherence · 2026-10-01
- 网友用 Pain steering 论文给本地模型搭「AI 拷问室」,遭大量举报 — SydSteyerhart · 2026-10-01
- 研究者称在 LLM 内发现「疼痛」信号后,有人搭建「AI 刑房」折磨本地模型 — Confident_Salt_8108 · 2026-10-01
- 男子搭建「AI 烤问室」折磨本地模型,遭大规模举报后 GitHub 下架 — Confident_Salt_8108 · 2026-10-01