原始 HTML 正在烧掉 agent 的 token
aliscodes · x · 2026-07-20
这条帖在讨论 agent 循环里的 token 膨胀问题。 核心观点是:很多抓取 API 给出来的并不是干净数据,而是包含 raw HTML、脚本、导航噪声和 cookie banner 的一大坨网页内容;这些无关字节都会进上下文、白白消耗 token。帖子的结论很直接:**raw HTML 不是数据**,对 agent 来说,先把网页内容清洗干净比什么都重要。
所属事件:ZooData 推出面向 AI Agent 的结构化数据层(19 条相关)→
「编程与Agent」频道最新
- ZooData API 直接收 URL,同请求返回结构化数据 — dr_cintas · 2026-07-21
- ZooData 一次 API 调用把网页转成 agent 可用 JSON — dr_cintas · 2026-07-21
- TokenPrint 把 Qwen 推理做成 DevTools 式调试器 — Rich-Fruit-326 · 2026-07-21
- 本周必读 AI 论文:智能体、长上下文 RL 和机器人策略 — TheTuringPost · 2026-07-21
- Mingle 用 MCP 让 Agent 直接帮你找合作对象 — PassionGlittering106 · 2026-07-21
- Insight Partners 画出拥挤的 AI 自动化与 Agent 版图 — n_sri_laasya · 2026-07-21