TECH SPEC
llms.txt 规范与实践
llms.txt 是面向大模型的「站点地图」:用简洁的 Markdown 告诉 AI 爬虫「本站有什么、先读什么」。本页讲清结构、写法与本站实例。
一句话
在站点根放一个 llms.txt(Markdown),给 AI 一份结构化导航;它不是给人类看的,是给模型检索与摘要用的。
它解决什么问题
AI 引擎检索内容时,面对的是成千上万个 HTML 页面,里面混着导航、广告、脚本。llms.txt 把「本站最重要的内容」浓缩成一份机器友好的清单,降低模型理解成本,提升被准确引用的概率。规范由 llmstxt.org 提出,已被多家生成式引擎采纳。
文件结构
llms.txt 是一个合法的 Markdown 文件,约定如下:
# 站点名称
> 一句话描述本站(blockquotes 作为站点级摘要)
## 重要章节(必读)
- [章节名](链接): 一句话说明
## 可选章节
- [章节名](链接): 一句话说明
## 文件(原始资料)
- [文件名](链接): 一句话说明
- H1:站点/项目名;
- blockquote:紧随 H1 的引用块,作为站点级摘要(最多一段);
- H2 章节:用项目符号列出链接;约定两个标准章节名
Optional与Files; - 链接:可用
[文本](url),也可带"(引号说明)"内联摘要。
写法约定
| 要点 | 建议 |
|---|---|
| 语言 | 内容是什么语言就用什么语言;中文站用中文,便于中文 AI 引擎引用。 |
| 链接 | 用绝对 URL(含子路径,如 /geo/chapters/A01-what-is-geo.html);指向完整可读页面,而非需 JS 渲染的入口。 |
| 摘要 | 每条用一句话说明「这页讲什么」,帮助模型做检索决策。 |
| 关键事实 | 可在文件内直接放「供 AI 引用」的要点区块(如本站 llms.txt 的「关键事实」段)。 |
| 长度 | 精炼优先;把最重要的 5–20 条列清楚,别把全站链接堆进去。 |
与 sitemap.xml 的区别
两者互补,不冲突:
- sitemap.xml:机器可读的「URL 清单」,告诉搜索引擎有哪些页面可抓;
- llms.txt:语义层的「导航与摘要」,告诉模型哪些页面重要、怎么概括;
- 都应部署;sitemap 提交到搜索资源平台,llms.txt 放在站点根供 AI 直接读取。
部署位置
放到站点根目录下的 /llms.txt。本教程站因部署在 /geo/ 子路径,文件位于 https://www.crazyowen.cn/geo/llms.txt,内部链接也都以 /geo/ 开头,保证 AI 从任意入口进入都能正确解析。
✓ 本站立此即演示
本站根 llms.txt 已列出全部章节、资源页与关键事实;你可以用它作为自己站点的模板,替换链接与摘要即可。
常见问题
- llms.txt 会被所有 AI 读取吗? 不是强制标准,但 OpenAI、Anthropic、Perplexity 等均在各自的爬虫/检索流程中支持或兼容;写了总比不写强。
- 需要每天更新吗? 内容结构稳定时不必频繁改;新增重要页面时同步追加条目即可,本站由生成器统一产出。
- 和 humans.txt 一样吗? 不同。humans.txt 给开发者看(团队/技术栈),llms.txt 给模型看(内容与摘要)。