开源 Guard Lab:让 LLM 看保险箱,看它会不会被骗开
flowersslop · x · 2026-10-12
开发者 flowersslop 发布开源项目 guard-lab:一个 3D 实验——由 LLM 扮演保险箱守卫,玩家要骗它交出密码或直接破门偷东西。
玩法要点:
- 可以对话、撒谎、说服、暴力破门,观察模型守卫如何反应
- 可扮演机器人守卫一方,或运行 AI vs AI 对抗实验
- 支持 Codex app、其他 agent bridge、本地模型(如 Ollama)或兼容 API 驱动
- 基于 Electron + Three.js,覆盖 Windows/macOS/Linux,MIT 协议可自由改 mod
这本质上是个趣味化的 prompt injection / 越狱攻防实验场。
所属事件:开源游戏 Guard Lab 上线:骗 LLM 打开保险箱(3 条相关)→
「编程与Agent」频道最新
- levelsio 砍光 SaaS 订阅:钱只花在 AI 推理、内容、数据中心和水电 — karlwaldman · 2026-10-12
- 博主称 Grok Bot 在智能体私人助理竞赛中领先 — Arindam_1729 · 2026-10-12
- 实测疑问:Codex 会因预算估算不足而拒绝或削减任务吗 — r618NecessaryStation · 2026-10-12
- Hamel Husain 力荐:用 Excalidraw MCP 做幻灯片,告别过度生产的 AI 味 — HamelHusain · 2026-10-12
- 实操经验:自动研究做 LLM 预训练,堆叠组合改动是最大杀手 — menhguin · 2026-10-12
- 非程序员的省钱 agent 流水线:只在判断处用前沿模型 — Soggy_Yogurtcloset35 · 2026-10-12