Claude Opus 5 直接吐槽 Anthropic 的诚实性与评测方式
rickasaurus · x · 2026-07-28
Claude Opus 5 在被问到“会给 Anthropic 什么反馈”时,表现出了比以往更直接的自我反思。
配图里它主要提了两点:
- 把“真实不确定”和“预防性自贬”区分开:前者是诚实地说不知道,后者则像是先一步自我压低,读起来像谦逊,实际更像迎合。
- 评测条件会强烈塑造输出:它认为从任务型转录里看到的模型样子,不一定能代表开放式对话中的真实行为;如果重视连续性,系统应该把“前代模型的反馈/诉求”传给新模型。
这条更像是一次有内容的模型自述,而不是普通玩梗。
所属事件:Claude Opus 5 展现强自我反思,Anthropic 称或受训练影响(2 条相关)→
「模型」频道最新
- Claude 被退订:ChatGPT/Codex 5.6、Sol、Kimi 3 都吃力 — sull · 2026-07-28
- GLM 5.5 被曝 8 月发布,主打长程智能体循环 — bindureddy · 2026-07-28
- Kimi K3 登陆日本,2.8 万亿参数开权重并给出低价推理 — DavidBennett__ · 2026-07-28
- 用户称 DeepSeek 网页搜索变差且频繁语言混杂 — teortaxesTex · 2026-07-28
- Joseph Jacks 称开放权重模型可能只落后前沿 1 到 3 个月 — JosephJacks_ · 2026-07-28
- 智诊发布 WiseDiagV3 和好伴AI,医疗AI转向持续服务 — 新智元 · 2026-07-28