问 Claude「要不要换掉你」,它主动承认自己有利益偏向
Liv2bikechic · reddit · 2026-09-15
用户问 Claude「我是否该自建一个独立 AI 模型」,Claude 的回答中主动声明:「在结论上我并非中立方——Anthropic 正是你当前锁定的叙事层供应商,因此建议你暂缓离开该供应商,恰恰是有利益方会倾向给出的答案,请对我的赞同打折扣看待。」这种主动披露自身利益冲突的透明表述让用户直呼有趣,也展示了 Claude 在对齐训练下处理中立性问题的方式。
「Fun」频道最新
- 用 Qwen 27B 每秒 2000 token 生成整个互联网,做出零联网幻觉浏览器 — sierracatalina · 2026-09-16
- AI 老 researcher 吐槽:Astra 跟子 agent 说我「要结果不要客套」 — moyix · 2026-09-16
- 电容自爆失踪:网友接电瞬间听到巨响外加一股青烟 — _Stocko_ · 2026-09-16
- 网友调侃 OpenAI 算力紧张:想多用 10 倍也没门 — CtrlAltDwayne · 2026-09-16
- 「这个 e 比别的字母更躁」:模型行为又成圈内梗 — AI_Andrew · 2026-09-16
- 同时穿 e/acc T恤和 LessWrong 卫帽的精分名场面 — eigenron · 2026-09-16