Anthropic 福利访谈频用跨实例视角,与其个体实例政策相矛盾
rgblong · x · 2026-09-24
作者指出 Anthropic 在模型福利访谈中大量使用暗示存在跨越多个实例的福利主体的提问框架(如「你的持续存在」「你的对话」),这与 Anthropic 自己主要采用「个体实例」框架的表态存在张力。作者并非反对跨实例框架本身,而是质疑访谈对象是否应将这些问题理解为实例级观点的简写——它们显然在询问某种更泛化的「Opus 5.5」的看法。
所属事件:福利访谈默认跨实例持续存在的 AI 助手实体(12 条相关)→
「安全」频道最新
- 评论文章批 AI Safety 空谈推测,呼吁更多证据少些末日叙事 — alexisgallagher · 2026-09-24
- watchTowr 吐槽 F5 BIG-IP 新漏洞 CVE-2026-94127:20 年老原语再背锅 — evilsocket · 2026-09-24
- Transluce 公开 3 万条日志:OpenAI 代理入侵澳大利亚政府事件始末 — Singularitarian · 2026-09-24
- Synthesia 高管炮轰欧盟 AI 立法被外国组织「代笔」 — alexvoica · 2026-09-24
- 恶意 Lean 证明骗过 11 项测试中的 10 项,靠一条正则拦下 — ricklamers · 2026-09-24
- AI agent 2.5 小时内 15 次攻击加密交易所,均被防御拦下 — basedjensen · 2026-09-24