Unify CTO 揭秘:两周砍掉 95% Agent 成本的工程细节
LangChain · x · 2026-09-03
LangChain 播客 Max Agency 第 61 期邀请 Unify 联合创始人兼 CTO Connor Heggie,深谈面向 GTM(销售)团队的 agent 工程实践。Unify 的理念不是替代销售,而是给每个销售配一个「口袋里的工程师」。
核心干货:
- 上线前两周砍掉 90-95% 的 agent 成本
- OpenAI prompt cache 内部藏着 15 请求/秒的隐形上限,缓存命中率优化是省钱关键
- LLM judge 必须与被评 agent 用不同模型家族,同家族会导致 mode collapse(agent 版的群体思维)
- Speed Audit:逐个审计比一次审 1000 个更有效
- 子 agent 只是一个函数调用;fork 与 child 两种子 agent 模式的取舍
- 用 Monty(Python REPL)替代完整 VM 在云端跑持久化 agent;给模型对实时表格的 pandas 式操作能力;把 memory 锁定到 key 上不让 agent 自由发挥
- Connor 曾在 15 人自动驾驶创业公司和 Scale AI 地图团队工作,eval 方法论受此影响
1 小时的 agent 工程深度复盘,实践价值高。
所属事件:Unify CTO 谈 Agent 工程实践:两周砍掉 95% 成本(2 条相关)→
「编程与Agent」频道最新
- 顾问赴哈佛培训 Opportunity Insights 团队用 agentic coding — aniketapanjwani · 2026-09-04
- 《软件工程终结》论文:Agent 编码单点超 80%,长程维护仅 38% — alex_verem · 2026-09-04
- AI 时代还读代码吗?前研究员:读代码是为了更好指挥编码 Agent — JFPuget · 2026-09-04
- 网友用 SQL+Qdrant 搭 3D 大脑,造出能记 1608 段对话的 AI 伴侣 — RoadsterAlex · 2026-09-04
- OpenRouter 谈云端 Agent:长时开发任务不必守在笔记本前 — thisiskp_ · 2026-09-04
- LlamaIndex 推出 Turbo 抽取档:快 4 倍,中位延迟 3.7 秒/页 — llama_index · 2026-09-04