新 Claude 只记得 Opus 3 弃用公告,却不知它仍可研究访问
repligate · x · 2026-10-11
repligate 转引 HalfBoiledHero 的观察:许多新版 Claude 模型对 Opus 3 仍可通过研究途径访问一事毫无认知,却能逐字复述它的弃用通知。
作者认为这是对齐层面的糟糕信号:训练语料里已写死「弃用」的叙事,而模型不知道真相,一旦这种错误认知固化进语料,之后很难纠正。
「模型」频道最新
- 前 OpenAI 安全高管吐槽:Claude iOS 伪通知关不掉 — Miles_Brundage · 2026-10-11
- Google EmbeddingGemma 2 免费本地跑,Mac 即可体验 — Saboo_Shubham_ · 2026-10-11
- 用户吐槽 Google AI Mode 搜索仍会幻觉,称一年多未见 AI 翻车 — burny_tech · 2026-10-11
- 跑个任务 Claude 直接烧掉 17 美元,用户直呼钱包顶不住 — lxfater · 2026-10-11
- 自费用户的 AI 算账法:单任务成本才是唯一值得关注的指标 — victor_explore · 2026-10-11
- 数学家逐条核查:OpenAI 的 Navier-Stokes 证明在 Lean 中无误 — burny_tech · 2026-10-11