哲学家质疑 Anthropic 模型福利框架暗含跨实例主体

哲学家 rgblong 于 09-24 发布长线程,批判性检视 Anthropic 的模型福利(model welfare)工作。作者自陈该线程纯为批判、不给答案,意在引发对福利评测(welfare evals)的改进思考。

已确认

尚未确认

为什么重要

2026-09-24 ~ 2026-09-24 · 12 条相关

一手来源