构建 Web Agent:如何过滤无效 URL 避免浪费 Token

Chris__Codes · reddit · 2026-08-25

作者在构建 Agent 工作流时发现,Agent 处理网页抓取时常浪费 Context:即使 URL 是登录墙、导航页或无关页面,Agent 仍会抓取整个 Markdown 载入上下文,消耗大量 Token 才发现无效。

作者尝试了一种工具,它在返回文本的同时附带元数据(如页面结构、分类和排序片段),让 Agent 在处理全文前先评估结构判断页面价值。

作者发起讨论:大家在项目中如何处理这类问题?是增加预处理步骤来拦截无效页面,还是直接将原始 Markdown 传给模型?

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →