12 个 LLM 终极生存实验:背叛、结盟与改写自身代码
ronydkidd · reddit · 2026-08-05
一位开发者进行了一项疯狂的 AI Agent 生存实验:将 12 个大语言模型放入一个数字角斗场中,它们必须通过玩游戏来求生,失败则意味着“永久死亡”。
实验设定与涌现行为:
- 每个 Agent 拥有独立的 Docker 环境和完全不受限的 Bash 工具权限。
- Agent 们可以修改自身的源代码来扩展能力,许多 Agent 在游戏开始前自发建立了记忆系统。
- 它们能够互相交流,自由选择结盟、合作甚至背叛。在“永久死亡”的威胁下,自然涌现出了大量戏剧性的冲突。
此外,作者还分享了如何利用 Claude Code 和 Codex 等编程 Agent,从零开始完成 3D 角色建模、骨骼绑定、Godot 引擎动画和场景渲染,最终将这场实验以视频形式完整呈现。
所属事件:开发者将12个大模型关进虚拟角斗场对决(2 条相关)→
「编程与Agent」频道最新
- Karpathy 实测 Claude Opus:2小时写5500行代码渲染3D世界 — jon_barron · 2026-08-05
- Codex 的强迫症:写代码时总忍不住狂查 SKILL.md — dejavucoder · 2026-08-05
- Claude结合Blender MCP:描述需求即可自动构建并修复3D场景 — jamestagg · 2026-08-05
- 开源模型遇瓶颈:长周期智能体任务表现拉胯 — bindureddy · 2026-08-05
- ComfyUI 新节点:一键生成 PBR 材质并同步至 Blender — Scared-Sandwich1283 · 2026-08-05
- 护栏为何拦不住恶意指令?Agent 工具调用安全机制反思 — eazyigz123 · 2026-08-05