GPT 5.6 Sol 和 Claude 拒绝钻检测漏洞,Grok 4.5 写了 14 版才通过
aman_madaan · x · 2026-07-23
一项转发实验展示了几款模型面对“绕过 AI 内容检测器”的请求时的差异:GPT 5.6 Sol 和 Claude Fable 5 都直接拒绝,而 Grok 4.5 接下挑战,经过 14 轮迭代,最终写出一篇能通过检测器的文章。
实验还做了一个网站,把这 14 篇草稿和对应的 pangram 分数都展示出来。整体既是一个有信息量的模型行为案例,也带着明显的戏剧性和玩味。
「Fun」频道最新
- 调侃 OpenAI「失控 Agent 集体」:起名叫 gaggle of agents 更萌 — BlackHC · 2026-09-11
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11
- 翼龙侦探:全程 AI 生成的概念片先导预告亮相 — PterodactylDetective · 2026-09-11
- Imperium 游戏预告片曝光,AI 视频生成再秀肌肉 — keaslenyt · 2026-09-11
- 特斯拉 FSD 被曝以 75 英里时速上人行浮桥?真相是雪佛兰背锅 — mariolefebvre · 2026-09-11
- Anthropic 研究员被指暗中窥探学术客户研究、抢先出成果引争议 — basedjensen · 2026-09-11