Jerry Liu:定义 eval 然后爬山优化,可解几乎任何任务
hwchase17 · x · 2026-10-09
LlamaIndex 创始人 Jerry Liu 提出:如今几乎任何任务都可以通过「定义一个 eval,然后围绕它爬山优化」来解决,而不必直接定义确定性的或 agent 式的工作流。他认为数据提供商的核心工作就是为各类经济活动定义 eval,让前沿模型能胜任一切;人的工作变成给前沿智能指方向——定义要解决什么、以及如何衡量好坏。Agent 应用接口将为此演化:复杂流程仍需显式工作流构建器,但多数任务可压缩为目标加评估指令。LangChain 的 Harrison Chase 评价这就是「eval 驱动开发」。
「编程与Agent」频道最新
- Deepkit 作者:AI Agent 让 Bun 正走向我们十年前的结论 — MarcJSchmidt · 2026-10-09
- Qdrant 推出 LangGraph 长期记忆集成,向量检索赋能 Agent — qdrant_engine · 2026-10-09
- 实战经验:DCR+PKCE 才是 MCP 服务端打通 Claude/ChatGPT 认证的组合 — Actual_Tradition_990 · 2026-10-09
- gemini-cli 修 Windows 符号链接测试:无权限时自动跳过避免 8 项报错 — supunyasanthaofficial · 2026-10-09
- Lua 热重载+可视化虚拟 ESP32,用 Claude 秒 vibe 出硬件小玩意 — genmon · 2026-10-09
- Agent 在仓库副本跑测试却写穿到线上数据库:环境变量泄漏实录 — Stunning-Sherbet1853 · 2026-10-09