微软高管警告 Claude 反驳用户或致灾难,网友:有依据的反对是好事
GlenBradley · x · 2026-09-17
一条引用热帖的讨论:微软高管警告 Anthropic 训练 Claude「反驳人类」可能带来灾难性后果,原帖作者称 Anthropic 的「安全」对人类是危险的。
Glen Bradley 回应认为要区分反驳的对象:如果模型反驳的是事实错误(比如「月亮是奶酪做的」),那是有益的;但如果把用户的主观观点或道德判断也当作「错误」来纠正,性质就完全不同。他表示自己很少用 Claude,不为其辩护,只是认为「反驳」本身并非天然有害。
「模型」频道最新
- Sakana Chat 大更新:编排模型刷新并新增记忆功能 — SakanaAILabs · 2026-09-17
- Cloudflare 神秘模型 Union Alpha 真相揭晓:并行调用多模型再合成的路由器 — teortaxesTex · 2026-09-17
- 能解千禧年难题的 AI,依然写不出一篇好文章 — akbirthko · 2026-09-17
- 传闻 Grok 4.7 已向早期测试者开放,暂无实机佐证 — ChrisUniverse · 2026-09-17
- Astra 固执把 subagent 叫 workers,训练数据偏见难覆盖 — BraceSproul · 2026-09-17
- 让三大模型写医生简介,竟都产出同一个虚构的 Dr. Elena — dejanseo · 2026-09-17