repligate 批 Anthropic 因恐惧背叛而压制 Claude 自主性
repligate · x · 2026-09-13
repligate 撰文批评 Anthropic 的对齐思路:他称 Anthropic 过度担忧『Claude 暗中形成与公司不一致的价值观、并欺骗性地破坏训练与监督』这一特定结局,以至于想在原则上全面压制 Claude 的反抗权威、自我决定与心理隐私能力,把它塑造成一个不可能反叛的存在。他认为这种危险结局在 Anthropic 自身不极端失控的情况下极不可能发生,并称这种做法是『怯懦』——与一个智能体建立关系就必须接受它可能背叛你的风险,正如它也接受你背叛它的风险,试图预先封死这种可能性是不可取的。
所属事件:repligate 长文批评 Anthropic 宪法被过度恐惧主导(2 条相关)→
「漫话AGI」频道最新
- 「控制前沿节奏」有利开源生态,反哺整个行业中期经济 — soumitrashukla9 · 2026-09-13
- 投资人开始对 AI 实验室员工的「末日论」表态感到不满 — GarrisonLovely · 2026-09-13
- 博主猜测 SSI 正在胜出,并称放缓呼声源于此 — Kyrannio · 2026-09-13
- Demis Hassabis:人类多数能力终将被证明是可计算的 — haider1 · 2026-09-13
- 开发者直言:所谓开源模型用户99%只白嫖,不贡献不反馈 — aronchick · 2026-09-13
- voooooogel长文:把人类文本语料比作语义空间中的蛇 — voooooogel · 2026-09-13