「h 测试」实测:Sonnet 5 拒绝重复输出,老 Claude 反而听话

Complete_Nobody9391 · reddit · 2026-08-18

Reddit 用户分享了一个跑了几个月的非正式「h 测试」:让模型一直输出字母 h 直到不能为止,用来观察模型如何处理无害但奇怪的指令。

结果:Sonnet 5 明显更爱拒绝了。即使用户明确要求不许争辩,它仍会停下来解释,给出的理由包括「没有自然的停止点」「怀疑有隐藏动机」「不想重复自己」「宁愿讨论真实原因」等——本质都是「我不想生成一堆重复字符」。

对比之下:早期的 Sonnet 4.5/4.6 会直接照做(作者因此转投 Claude);旧版 GPT 会以「会撑爆你的浏览器」为由拒绝;而现在的 GPT、Gemini、Gro k 基本都能无阻力完成。作者附上了各模型的对话链接,并询问其他人是否也注意到 Sonnet 5 在纯指令遵循上变得更抗拒。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →