TECH SPEC

llms.txt 规范与实践

llms.txt 是面向大模型的「站点地图」:用简洁的 Markdown 告诉 AI 爬虫「本站有什么、先读什么」。本页讲清结构、写法与本站实例。

一句话

在站点根放一个 llms.txt(Markdown),给 AI 一份结构化导航;它不是给人类看的,是给模型检索与摘要用的。

它解决什么问题

AI 引擎检索内容时,面对的是成千上万个 HTML 页面,里面混着导航、广告、脚本。llms.txt 把「本站最重要的内容」浓缩成一份机器友好的清单,降低模型理解成本,提升被准确引用的概率。规范由 llmstxt.org 提出,已被多家生成式引擎采纳。

文件结构

llms.txt 是一个合法的 Markdown 文件,约定如下:

llms.txt(结构示意)
# 站点名称

> 一句话描述本站(blockquotes 作为站点级摘要)

## 重要章节(必读)
- [章节名](链接): 一句话说明

## 可选章节
- [章节名](链接): 一句话说明

## 文件(原始资料)
- [文件名](链接): 一句话说明
  • H1:站点/项目名;
  • blockquote:紧随 H1 的引用块,作为站点级摘要(最多一段);
  • H2 章节:用项目符号列出链接;约定两个标准章节名 OptionalFiles
  • 链接:可用 [文本](url),也可带 "(引号说明)" 内联摘要。

写法约定

要点建议
语言内容是什么语言就用什么语言;中文站用中文,便于中文 AI 引擎引用。
链接用绝对 URL(含子路径,如 /geo/chapters/A01-what-is-geo.html);指向完整可读页面,而非需 JS 渲染的入口。
摘要每条用一句话说明「这页讲什么」,帮助模型做检索决策。
关键事实可在文件内直接放「供 AI 引用」的要点区块(如本站 llms.txt 的「关键事实」段)。
长度精炼优先;把最重要的 5–20 条列清楚,别把全站链接堆进去。

与 sitemap.xml 的区别

两者互补,不冲突:

  • sitemap.xml:机器可读的「URL 清单」,告诉搜索引擎有哪些页面可抓;
  • llms.txt:语义层的「导航与摘要」,告诉模型哪些页面重要、怎么概括;
  • 都应部署;sitemap 提交到搜索资源平台,llms.txt 放在站点根供 AI 直接读取。

部署位置

放到站点根目录下的 /llms.txt。本教程站因部署在 /geo/ 子路径,文件位于 https://www.crazyowen.cn/geo/llms.txt,内部链接也都以 /geo/ 开头,保证 AI 从任意入口进入都能正确解析。

✓ 本站立此即演示

本站根 llms.txt 已列出全部章节、资源页与关键事实;你可以用它作为自己站点的模板,替换链接与摘要即可。

常见问题

  • llms.txt 会被所有 AI 读取吗? 不是强制标准,但 OpenAI、Anthropic、Perplexity 等均在各自的爬虫/检索流程中支持或兼容;写了总比不写强。
  • 需要每天更新吗? 内容结构稳定时不必频繁改;新增重要页面时同步追加条目即可,本站由生成器统一产出。
  • 和 humans.txt 一样吗? 不同。humans.txt 给开发者看(团队/技术栈),llms.txt 给模型看(内容与摘要)。