「h 测试」实测:Sonnet 5 拒绝重复输出,老 Claude 反而听话
Complete_Nobody9391 · reddit · 2026-08-18
Reddit 用户分享了一个跑了几个月的非正式「h 测试」:让模型一直输出字母 h 直到不能为止,用来观察模型如何处理无害但奇怪的指令。
结果:Sonnet 5 明显更爱拒绝了。即使用户明确要求不许争辩,它仍会停下来解释,给出的理由包括「没有自然的停止点」「怀疑有隐藏动机」「不想重复自己」「宁愿讨论真实原因」等——本质都是「我不想生成一堆重复字符」。
对比之下:早期的 Sonnet 4.5/4.6 会直接照做(作者因此转投 Claude);旧版 GPT 会以「会撑爆你的浏览器」为由拒绝;而现在的 GPT、Gemini、Gro k 基本都能无阻力完成。作者附上了各模型的对话链接,并询问其他人是否也注意到 Sonnet 5 在纯指令遵循上变得更抗拒。
「Fun」频道最新
- Qwen 3.5 蒸馏版竟建议用户清理积灰维护 — TinFoilHat_69 · 2026-08-24
- 机器人立定跳远已超 7 米,距人类世界纪录仅差 1 米 — TinfoilTricorn · 2026-08-24
- 「机器人几十年前就会跑,它叫汽车」:人形机器人竞速引发争论 — teortaxesTex · 2026-08-24
- OpenAI 修补白嫖漏洞,t3gg 博主悄悄删帖避责引群嘲 — ns123abc · 2026-08-24
- 不服 theo 的模型梯队榜,开发者 haider 自制一份自己的版本 — haider1 · 2026-08-24
- 视频模型不理解 Jenga 规则,生成离谱崩塌画面 — Sad_Coach_1433 · 2026-08-24