福利评测难究每个道德主体观?作者倡议逐项标注所涉个体化视角

rgblong · x · 2026-09-24

作者总结其批判性线程:Anthropic 福利卡片称要调查「道德主体可能是什么的每一种观点」是「不可行」的,这固然属实;但作者建议在每项评估或干预中明确标注其意图针对的是哪一种个体化视角。作者强调此线程纯为批判、不给答案,目的是引发关于如何结合个体化哲学难题改进模型福利评测的进一步正面思考。

所属事件:福利访谈默认跨实例持续存在的 AI 助手实体(12 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →