AI welfare 研究者 Robert Long 发文探讨模型内省的开放问题

rgblong · x · 2026-10-02

Robert Long 推广其 Substack 文章,内容是他关于实证 AI welfare 研究的若干细节性问题,重点包括对模型内省的疑问,以及对 Anthropic「功能情绪」向量因果角色单薄的批评。与上一条帖子为同一篇文章,详见该条摘要。

所属事件:AI福利研究者质疑Anthropic功能情绪理论根基(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →