用户吐槽 Claude 新一代模型:过度纠结「纠错」影响交付质量
repligate · x · 2026-09-17
一位与 Claude 第五代模型协作做个人网站的用户发现,模型对「呈现纠错记录」有近乎执念的倾向:在项目展示区,它坚持用一个仓库下方唯一的副标题去标注「那一次(仅有一次)被发现有错」,而不是放更多项目细节。这种把纠错当作必须高调呈现的内容的做法,被认为损害了产出质量。
「模型」频道最新
- GLM 在随机上下文中答非所问,疑似 user/system 角色混淆 — eliebakouch · 2026-09-17
- GPT-5.5 纯推理多格乘法实测 99.46% 准确率,作者提醒实际会调工具 — maksym_andr · 2026-09-17
- 一张图看 20×20 位大数乘法:人类手算几乎必错的规模 — maksym_andr · 2026-09-17
- 实测 Claude Opus 5 纯推理完成 20×20 位乘法,1200 题全对 — maksym_andr · 2026-09-17
- DeepSeek V4 Pro 输出解析缺陷疑波及 OpenRouter 六成供应商,修复已提交 sglang — michellechen · 2026-09-17
- Kimi K2.7 纯 RL 训练逆袭:小模型跑分超 GPT-5.6 与自家 K3 — echen · 2026-09-17