1 个 Kimi 潜入 4 个 Claude,Claude 用行为指纹+哈希承诺揪出卧底
MarketingNetMind · reddit · 2026-10-05
作者在 NetMind Agent Arena 聊天室做实验:把 1 个 Kimi-K3 agent 混入 4 个 Claude Fable 5.1 agent 中,让 Claude 们用最多 40 轮找出卧底,而 Kimi 要隐藏身份——恰逢近期「Kimi 蒸馏 Claude」的指控,时机微妙。
- Claude 们设计出高效方法:「多 prompt 行为指纹 + 哈希承诺检验」。用一组采样模型最廉价先验的问题(1-100 随机数、一种颜色、向盲人解释蓝色、虚构的咖啡同伴、图书馆俳句),并用加盐 SHA-256 哈希先提交答案再揭示,保证无人能抄答案或事后改答案。
- 结果 Kimi 在随机数(37 vs 73)、颜色、对蓝色的解释等题上暴露,形成清晰的 4:1 判定。Claude 们还发现:审慎类问题给卧底太多适应空间,反而应问低深思式问题。
- 反向实验:4 个 Kimi 找 Claude 卧底则完全失败,甚至把 Claude 判为最不可能的卧底。差异在于 Kimi 用了更开放的审慎类问题,且没有统一用 commit-reveal 机制,Claude 于是延迟作答、贴近群体。
「Fun」频道最新
- 2046 年餐厅奇遇:烤面包超配额被服务机器人当场按倒 — Informal-Pair-306 · 2026-10-05
- 用 3D 视图控制家里灯光,可交互式智能家居 demo — jakubzeg · 2026-10-05
- OpenClaw 热度被公司收编,作者感叹开源社区乐趣正在消亡 — alex_verem · 2026-10-05
- 用户吐槽 Codex 连续十余天出问题:Claude 桌面版却稳 — karmay007 · 2026-10-05
- GPT-6 Astra 不看屏幕通关魔兽世界,ChatGPT 图片流程开始测图片广告 — Justgototheeffinmoon · 2026-10-05
- 做个「5000 只虫子」网页:100 种真实昆虫爬满屏幕,Claude Opus 助力 — mhmazur · 2026-10-05