LangSmith 推出 Fine-Tuning:用 agent trace 直接微调专用小模型
baseten · x · 2026-09-25
LangChain 推出 LangSmith Fine-Tuning 与 smithtune CLI(公测),把微调全流程纳入 LangSmith:直接用平台里积累的 agent trace 数据训练专用模型,目标是降低成本与延迟。Baseten 随后确认 smithtune 训练已在其 Loops 推理平台上运行。对 agent 团队来说,这是一条把线上观测数据转化为更便宜更快专用模型的可复用路径。
所属事件:LangChain 发布 LangSmith Fine-Tuning 公测(9 条相关)→
「编程与Agent」频道最新
- Hill Sampling:以最佳已验证解为条件并行生成 512 个编辑迭代优化 — LChoshen · 2026-09-25
- Nat Friedman 回应泄密质疑:Verge 报道的是用户 VM 文件,本属预期行为 — dtrinh · 2026-09-25
- ServingStudio 发布:先仿真再上真机,省下昂贵的 GPU 试错成本 — bariskasikci · 2026-09-25
- issue-graph 用互动与时效信号为编码 Agent 排序待办工作 — Chamoen · 2026-09-25
- Claude 主动识别 bug、打包日志并请求用户提交报告 — ColleenMBrady · 2026-09-25
- NeurIPS 2026 论文 SkillRL:7B 模型胜 GPT-4o 41%,靠技能进化 — cihangxie · 2026-09-25