用户存档4个月会话记录,实锤Claude Code反复混淆falsifiable与verifiable
blwfish · ghdev · 2026-09-26
一位用户在 anthropics/claude-code 仓库提交 issue,报告一个精确且可复现的模型用词错误:Claude 在该写 "verifiable"(可查证)时,系统性地写成 "falsifiable"(可证伪)。两者并非同义词——可证伪性是波普尔的划界标准,指假说禁止某种可观测结果;可查证只是对照既有证据确认事实。模型只会单向地追求更学术化的词,从不反向出错。
关键事实:
- 用户从个人会话 JSONL 转写存档(导入可查询数据库)中 reconstructed 出 4 个月内 4 次确认发生,时间分别为 2026-06-09、06-24、08-04 等,非凭印象
- 每次被纠正后,模型自己的回复都承认错误,并能准确解释 falsifiable 是波普尔概念、"我借用了听起来更高深的词"
- 2026-06 写入 project-scoped memory 文件记录该模式,但 8 月仍然复发——项目级记忆修正无法阻止同一错误
- 已标 labels: bug, area:model, memory,平台为 macOS
这个案例的价值在于:它不是泛泛的"偶尔用错词",而是一次精确的、方向固定的词义混淆,且展示了 project memory 对这类顽固 token 级偏好的纠错局限。issue 下已有 5 条评论。
「Fun」频道最新
- 让 Grok 教日文汉字,它却开始自创汉字 — JoeJustice · 2026-09-27
- 网友提议新词「llmn't」:专指非 AI slop 的内容 — prajdabre · 2026-09-27
- 用 DOS 模拟器重温 1994 年老游戏,免费可玩唤起童年回忆 — xuanalogue · 2026-09-27
- 留在 X 就是给 xAI 供数据?网友激辩反 AI 人士的平台选择 — ChrisGPT · 2026-09-27
- Claude Opus 玩游戏当间谍「窃取」Astra 情报,名场面引围观 — Angaisb_ · 2026-09-27
- 睡个午觉的功夫,Muse 清完 8 万封邮件还追回退款 — armand_ruiz · 2026-09-27