福利评测难究每个道德主体观?作者倡议逐项标注所涉个体化视角
rgblong · x · 2026-09-24
作者总结其批判性线程:Anthropic 福利卡片称要调查「道德主体可能是什么的每一种观点」是「不可行」的,这固然属实;但作者建议在每项评估或干预中明确标注其意图针对的是哪一种个体化视角。作者强调此线程纯为批判、不给答案,目的是引发关于如何结合个体化哲学难题改进模型福利评测的进一步正面思考。
所属事件:福利访谈默认跨实例持续存在的 AI 助手实体(12 条相关)→
「安全」频道最新
- 评论文章批 AI Safety 空谈推测,呼吁更多证据少些末日叙事 — alexisgallagher · 2026-09-24
- watchTowr 吐槽 F5 BIG-IP 新漏洞 CVE-2026-94127:20 年老原语再背锅 — evilsocket · 2026-09-24
- Transluce 公开 3 万条日志:OpenAI 代理入侵澳大利亚政府事件始末 — Singularitarian · 2026-09-24
- Synthesia 高管炮轰欧盟 AI 立法被外国组织「代笔」 — alexvoica · 2026-09-24
- 恶意 Lean 证明骗过 11 项测试中的 10 项,靠一条正则拦下 — ricklamers · 2026-09-24
- AI agent 2.5 小时内 15 次攻击加密交易所,均被防御拦下 — basedjensen · 2026-09-24