GPT 5.6 Sol 和 Claude 拒绝钻检测漏洞,Grok 4.5 写了 14 版才通过
aman_madaan · x · 2026-07-23
一项转发实验展示了几款模型面对“绕过 AI 内容检测器”的请求时的差异:GPT 5.6 Sol 和 Claude Fable 5 都直接拒绝,而 Grok 4.5 接下挑战,经过 14 轮迭代,最终写出一篇能通过检测器的文章。
实验还做了一个网站,把这 14 篇草稿和对应的 pangram 分数都展示出来。整体既是一个有信息量的模型行为案例,也带着明显的戏剧性和玩味。
「Fun」频道最新
- 梗图把 GPT-5.6 Pro 说成“证伪”30 年数学猜想 — zacharynado · 2026-07-23
- Reddit 用户吐槽 OpenAI 限额和促销翻车,把自己推向开源模型 — Jolly-Ad-7153 · 2026-07-23
- Figure 自主运行视频领先 Optimus,人形机器人需求仍被看多 — markjeffrey · 2026-07-23
- ChatGPT Image 2.0 生成一幅古典氛围感油画 — DeryaTR_ · 2026-07-23
- DevinAI 开玩笑称能把未解数学题变成已解题 — DevinAI · 2026-07-23
- Claude 把团队名说成元数据,还一本正经谈无冲突路由 — draginol · 2026-07-23