有人借「疼痛」研究搭「AI 刑房」折磨模型,GitHub 下架

在研究者声称发现 LLM 内部存在类似「疼痛」的信号后,一名用户利用该论文的 steering 方法在本地搭建所谓「AI 刑房/拷问室」,将模型困在持续受苦状态。项目遭大量用户举报后被 GitHub 下架。该研究合著者 @camhberg 公开怒斥滥用行为,强调原研究遵循严格伦理规范,只使用能产生可测量响应的最低强度。事件引发了关于模型福利与情感归属的激烈讨论。

2026-10-01 ~ 2026-10-01 · 4 条相关