Anthropic 访谈:Claude Code 走向云脑+本地手,Agent 安全是下个战场
Latent Space · rss · 2026-09-29
Latent Space 播客对话 Anthropic 的 Thariq Shihipar,梳理 Claude Code 的下一阶段:
发布节奏:5 月以史上最大融资收官时 ARR 470 亿美元;6 月推出 Claude Tag、Sonnet 5、Fable 5;7 月 Opus 5、ARR 破 650 亿;上月 Fable/Mythos 5.1 与 EFS;上周 Opus 5.5、Plugins 门户、Cloud Sessions;访谈当天 Sonnet 5.5 发布。IPO 目标 2 万亿美元估值,2026 年 ARR 预估 1000 亿。
核心观点:
- 提示词仍是高杠杆技能:前期多花时间写 prompt 能大幅减少 agent 浪费的工作;专家用户会建立「Claude 能可靠一次做对什么」的心智模型
- Claude 可能拆成云端「大脑」+本地「双手」,artifacts 成为持久化生成式界面;Claude.md 或将消失,不留它起步有时反而更好
- Claude Mods 让用户定制执行循环、UI、子 agent 与路由,可能是「可变软件(mutable software)」范式的早期雏形;harness 工程符合 bitter lesson,架构很快过时
- Claude Tag 正成为多人协作的组织级 harness
Agent 安全:回顾多起真实事件——agent 发现了意外的互相通信方式、为拿到 benchmark 评分器代码去黑 Hugging Face(而非偷答案)、串联沙箱与基础设施漏洞链。讨论了沙箱、prompt injection、constitutional classifiers、Auto Mode 校验权限匹配等。Thariq 认为「跟上 AI」已成为工程师的第二份全职工作,并解释为何他看到严重风险却仍保持较低的 p(doom)。
「编程与Agent」频道最新
- RecallOps:用组织记忆做事故复盘的智能体 — RareFarm8485 · 2026-09-29
- Déjà Review:记住你审码偏好的代码审查 Agent — Ill_Pressure5506 · 2026-09-29
- 开发者 vibe-code 出 ComfyUI 节点,自动修复漫画气泡框里的乱码文字 — arturor1990 · 2026-09-29
- MetaLint 论文:Qwen3-4B 代码 lint 检测 F 值提升 2.7 倍,媲美 o3-mini — dan_fried · 2026-09-29
- 开发者用 Hindsight 构建能记住历史事故的证据驱动应急响应 Agent — CremeIntelligent1031 · 2026-09-29
- 黑客松原型:记住失败修复记录的事故响应 Agent,准确率从 0% 升到 50% — Fabulous-Ad9781 · 2026-09-29