给 Agent 用的免费 Web Research MCP
Opening_Library9560 · reddit · 2026-07-19
作者发布了一个给 AI agent 用的网页研究 MCP 服务 hound,主打“真正帮 agent 做检索和阅读”,而不是只给一个简单 fetch。
它提供 4 个核心工具:
- smartfetch:先 HTTP,必要时切浏览器/隐身浏览器,PDF 还能转成带目录和页码范围的 Markdown。
- smartsearch:并行接入 10 个免密搜索后端,带神经重排和熔断机制。
- smartcrawl:按站点结构抓取整站,优先相关页面。
- screenshot:给多模态 agent 用的真实渲染截图。
作者特别强调它会返回一组“诚实信号”,比如 contentok、pagetype、contentagedays、isstale、sourcetype、isofficial 和 nextaction,让 agent 知道自己拿到的是正文、登录墙、机器人验证页还是过期归档页。对 404 或 bot wall,它还能从 Internet Archive 拉最近快照并明确标记来源。
最后他把它和官方 MCP fetch、Firecrawl、Crawl4AI、Tavily、Serper/SerpAPI 做了对比,结论是:它在“免费、自托管、搜索+抓取+抗爬+死链恢复”这一组合上更完整,但也承认它打不过 DataDome、Akamai、Turnstile 这类更强验证。
「编程与Agent」频道最新
- 构建 AI Agent 安全网关:如何自托管多 SaaS 的 OAuth 集成 — Defiant_Cod_2654 · 2026-07-22
- Rowboat 作为开源本地优先 AI 同事上线 — ycombinator · 2026-07-22
- Reddit 用户串联 Ideogram 4 和 Krea2,复刻 bbox 定位效果 — v3lh0t05c0 · 2026-07-22
- Apollo 采用 Deep Agents 架构,AI 技能开发周期缩减 85% — LangChain · 2026-07-22
- Scoble 说 AI 的 loops 本质是长运行多智能体工作区 — Scobleizer · 2026-07-22
- Kimi Code 开放候补名单,Moonshot 推进编码产品 — Fabulous_Bonus_8981 · 2026-07-22