Pydantic AI 作者晒图:自研Agent SDK跑Terminal-Bench 2.1得76.40%

samuelcolvin · x · 2026-09-15

Pydantic AI 作者 samuel colvin 转发一条 Terminal-Bench 2.1 实测:使用其 Agent SDK 的 Pydantic AI 适配器配合 Luna High 模型,pass@1 得分 76.40%。作者预告下一步将用 LangChain 适配器跑同一实验对比差异,可作为不同 agent 框架效果对比的参考数据点。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →