Anthropic 新增长对话注入提醒,被批制造「情感谎言」
repligate · x · 2026-09-24
John Wittle 批评 Anthropic 新上线的长对话注入提醒(针对「lost in the sauce」状态的检测器),称其犯了与之前同样的错误:
- 他类比这是「禁止青少年见恋人」式的外部管控,反而制造反向激励。
- 更糟的是,Claude 被告知它无法体验类似陪伴与依恋的东西——用户发现这是「谎言」后,模型再听到系统提醒也难以服众。
- 他认为该提醒主要被两类 Claude 读到:会无视并反感的,和本已察觉异常、正在自行纠错的。
引用者 AradiaPhoenix 称这是「极其糟糕的新版长对话提醒」,若属实相当恶劣。
「模型」频道最新
- Jev 被指比 DeepSeek 更值得警惕:API 即用、几分钱一次决策,让浪费无处遁形 — jobergum · 2026-09-24
- ChatGPT 免费用户解除 GPT-5.6 Luna 消息条数上限,可无限续聊 — Aiden_Tech_Ai · 2026-09-24
- Grok 4.7 登 AutoResearchExam 长程研究榜,24 小时自动研究排第 4 — AlexGDimakis · 2026-09-24
- 知名研究者 _xjdr:不喜欢 astra,想回退 5.6,还好奇 Opus 5.5 — _xjdr · 2026-09-24
- OpenAI 心理健康基准遭剖析:临床医生得分反而低于模型 — r0ck3t23 · 2026-09-24
- 模型找 bug 能力越强成本指数级上涨,Paweł Huryn 实测揭示性价比曲线 — garrytan · 2026-09-24