开源小红书相关词爬虫 Skill:Codex 一小时抓万条长尾词并自动评分
vista8 · x · 2026-09-30
开发者 yaojingang 开源了两个 Codex Skill:小红书相关搜索词采集与百度相关搜索词采集(GitHub 仓库 yao-geo-skills)。
工作流程
- 将 skill 部署到 Codex 后输入一个或多个词根;
- Codex 自主操控浏览器逐词搜索,抓取搜索框下拉联想词,再逐个检索第一层词得到第二层,每条词保留真实截图、列表位置和来源路径;
- 去重后按行业商业意图对每条词打 1–10 分(不同行业评分逻辑不同),例如「留学公司」词根测得 110 条路径、93 个去重词,找机构、比排名类词分高,招聘/备案类经营词分低;
- 运行 buildworkbook.py 导出 Excel,含关键词表、采集记录、截图索引、去重词库、待采集五张表。
作者实测:抓取约 10000 条百度相关搜索长尾词,Codex 约 1 小时完成。可用于 SEO/GEO 的免费长尾词挖掘与选词。
「编程与Agent」频道最新
- 前 Google 工程师详解:TensorFlow 进入维护模式后如何迁移 — lmoroney · 2026-09-30
- Google 前开发者关系负责人确认:TensorFlow 已处维护模式 — lmoroney · 2026-09-30
- 用 LLM 逆向 SNES 游戏:作者称编码模型逆向能力狂飙 — gandamu_ml · 2026-09-30
- 用 Rust 自写静态类型语言 Lumen:下一步加带数据的 enum 与 match — Abhishekcur · 2026-09-30
- 用 Claude 生成 Remotion 视频:挑战真实产品 UI 展示 — EagleApprehensive · 2026-09-30
- 10 天把 SNES 马车搬进 Minecraft,连 AI 对手都逆向移植了 — gandamu_ml · 2026-09-30