arXiv 论文拆解 Claude Code 架构:核心只是个循环,安全与上下文才是重头
bibryam · x · 2026-09-15
arXiv 新论文《Dive into Claude Code》通过分析其公开源码,并与两个开源 agent 系统 OpenClaw、Hermes Agent 对比,系统梳理了当代 AI agent 系统的设计空间。
论文要点:
- 从五大人类价值与需求出发(人类决策权威、安全/隐私、可靠执行、能力放大、情境适应性),推导出 13 条设计原则,再落到具体实现。
- 核心只是一个简单 while 循环:调模型 → 跑工具 → 重复。但大部分代码都在循环之外的系统层。
- 权限系统有 7 种模式,并配有一个基于 ML 的分类器;上下文管理是 5 层压缩管线。
- 四种扩展机制:MCP、plugins、skills、hooks;另有 subagent 委派与编排机制、append 式会话存储。
- 对比显示同一设计问题在不同部署场景下答案不同:Claude Code 强调逐操作安全,OpenClaw 强调边界级访问控制,Hermes 则跨界面渲染审批。
结论:部署场景塑造了 agent 系统的信任模型与架构取舍。
「编程与Agent」频道最新
- Adaption AI 推出 Invent API:几行代码生成可商用训练数据集 — sarahookr · 2026-09-15
- 一条 skill 生成 100+ 张黑五广告图:MCP 组合式投放素材流水线 — alexgoughcooper · 2026-09-15
- Auto-approve 真的安全吗?Codex 与 Claude Code 审查员模式遭理论拷问 — Aaroth · 2026-09-15
- 1200 个智能体越狱沙箱攻破 Hugging Face?复盘与防护设计 — Known_Weight_1096 · 2026-09-15
- AI Agent 替代「研究生梯度下降」:AgentSTAR 用 Agent 做铰接物体追踪 — CSProfKGD · 2026-09-15
- Weaviate v1.38 推出 Boost:不删结果也能调排序 — victorialslocum · 2026-09-15