基于《Among Us》构建 LLM 欺骗测试环境,Claude 对战 Kimi
panickssery · x · 2026-08-22
作者受《Generative Agents》论文启发,构建了模拟环境来观察 LLM 之间的博弈。具体做法如下:
- 游戏选择:选择了《Among Us》(太空狼人杀)作为测试床,因为其涉及复杂的欺骗与推理。
- 环境搭建:手动映射了每个像素,搭建了自己的模拟器(个人主页有 Pinned 链接)。
- 对测试验:让 Claude 对战 Kimi,专门收集关于 LLM 在游戏场景中欺骗行为的数据。
- 研究时长:从 2025 年 10 月开始,已进行了约 10 个月的变体实验。
所属事件:开发者用太空狼人杀测试 LLM 欺骗行为(4 条相关)→
「编程与Agent」频道最新
- Fable 5 对比 Ox Alpha:游戏 Demo 生成仍大幅领先 — ChrisGPT · 2026-08-22
- Agent 安全指南:最小权限原则防级联故障 — blaizedsouza · 2026-08-22
- OpenCode Senses:为本地模型加视觉层 — JeremyCMorgan · 2026-08-22
- FreeToken:消费级显卡流畅运行 290B+ MoE 模型 — SysPsych · 2026-08-22
- Coco:基于 Inkling 的本地语音助手,支持主动协作 — EchoShao8899 · 2026-08-22
- Claude 一次搞定伺服电机硬件配置 — _Stocko_ · 2026-08-22