LangChain 发布 Clay 完整访谈:月百万 Agent 运行的评估实践
LangChain · x · 2026-09-10
LangChain 公布与 Clay 团队的完整对话视频。Clay 每月运行数百万次 agent 任务,人工审查在该规模下失效,因此采用 LangSmith 的在线评估器自动监控 agent 行为,并测试 insights 产品深入理解 agent 表现。
Jeff Barg 在访谈中详细解释了 Clay 的 agent 评估工作流。
所属事件:Clay 月跑百万级 Agent 任务,用 LangSmith 在线评估替代人工审查(2 条相关)→
「编程与Agent」频道最新
- Mollick:复杂长时任务没法人在环内,但可以监督整个循环 — emollick · 2026-09-10
- Mollick 谈驾驭长时 agent:插入指令还是排队分叉如何选 — emollick · 2026-09-10
- LLM 护栏的正确心智模型:独立于模型的输入输出检查层 — Careless_Sabfey_4906 · 2026-09-10
- Ethan Mollick:用 Codex 这类 agent,关键是学会「驾驶」它 — emollick · 2026-09-10
- AgentGrad:干预引导的 prompt 优化,提速 2.5 倍达 SOTA — _akhaliq · 2026-09-10
- Claude 内嵌 cyber 控件 vs Codex 独立编排模型,哪种架构更优? — HankYeomans · 2026-09-10