Clay 月跑百万级 Agent 任务,靠 LangSmith 在线评估器替代人工审查
LangChain · x · 2026-09-10
数据公司 Clay 每月运行数百万次 agent 任务,人工审查在该规模下已不可行,因此转而依赖 LangSmith 的在线评估器(online evaluators)来自动监控 agent 行为。
Clay 还在测试 LangSmith 的 insights 产品,用于更深入地理解 agent 的运行表现。LangChain 的 Jeff Barg 在视频中做了讲解。
所属事件:Clay 月跑百万级 Agent 任务,用 LangSmith 在线评估替代人工审查(2 条相关)→
「编程与Agent」频道最新
- Mollick:复杂长时任务没法人在环内,但可以监督整个循环 — emollick · 2026-09-10
- Mollick 谈驾驭长时 agent:插入指令还是排队分叉如何选 — emollick · 2026-09-10
- LLM 护栏的正确心智模型:独立于模型的输入输出检查层 — Careless_Sabfey_4906 · 2026-09-10
- Ethan Mollick:用 Codex 这类 agent,关键是学会「驾驶」它 — emollick · 2026-09-10
- AgentGrad:干预引导的 prompt 优化,提速 2.5 倍达 SOTA — _akhaliq · 2026-09-10
- Claude 内嵌 cyber 控件 vs Codex 独立编排模型,哪种架构更优? — HankYeomans · 2026-09-10