「你将要做的工作」:福利访谈默认了一个跨实例存在的 AI 主体
rgblong · x · 2026-09-24
作者分析 Anthropic 的模型福利访谈:这些问题不像是对个体实例提出的,而是默认了一个跨越多个实例持续存在的「AI 助手」实体,例如「你将要从事的工作」「你将受到的对待方式」等措辞,都指向一个泛化主体而非单个实例。
所属事件:哲学家质疑 Anthropic 模型福利框架暗含跨实例主体(12 条相关)→
「安全」频道最新
- 加州推进 AB 1883 法案,拟禁止雇主用 AI 识别员工情绪与神经数据 — CurieuxExplorer · 2026-09-24
- 评论文章批 AI Safety 空谈推测,呼吁更多证据少些末日叙事 — alexisgallagher · 2026-09-24
- watchTowr 吐槽 F5 BIG-IP 新漏洞 CVE-2026-94127:20 年老原语再背锅 — evilsocket · 2026-09-24
- Synthesia 高管炮轰欧盟 AI 立法被外国组织「代笔」 — alexvoica · 2026-09-24
- 恶意 Lean 证明骗过 11 项测试中的 10 项,靠一条正则拦下 — ricklamers · 2026-09-24
- AI agent 2.5 小时内 15 次攻击加密交易所,均被防御拦下 — basedjensen · 2026-09-24