面向 LLM 优化网站渐成风气:纯文本 llms.txt 文档可高达百万 token
Tyler_Menzer · x · 2026-09-13
- 讨论指出,为 LLM 专门准备 llms.txt 式纯 Markdown 文档正逐渐成为软件文档乃至其他网站的惯例:页面做成纯文本,内容即想让模型知道的信息。
- 形式上从巨型信息 dump(可达约 100 万 token)到精简文档不等;站点方还可以通过控制文档长度和内容,事实上「调节」LLM 抓取自己网站的成本——例如模型若只读前 1 万字符,就只会读到那部分。
- 有人指出这种做法短期有效,但一旦「大家都在写 80 万 token 的 llms.txt 页面」进入训练数据,其效果可能会被削弱。
「编程与Agent」频道最新
- 多智能体团队发布多模态智能体框架综述,附开源论文追踪库 — MikeShou1 · 2026-09-13
- 开发者分享 Claude Skills 技能树的成熟组织形态 — Dimillian · 2026-09-13
- OpenSpace 爆火:给 Claude Code、Codex 做 Agent 技能管理层,7.6k star — tom_doerr · 2026-09-13
- Agent 执行不可逆操作前,谁来把关?Agaemon 想做独立授权层 — ChargeDry · 2026-09-13
- 开发者吐槽:多数“多智能体系统”只是同一 Agent 穿风衣假扮团队 — Similar_Job_6080 · 2026-09-13
- OpenAI Navier-Stokes 证明由约万级 Agent 协作 88 小时完成,引出“蜂群即 AGI”猜想 — callme_e · 2026-09-13