llms.txt 是什么?怎么给网站配置(含完整代码示例,2026)
如果你在做 GEO(生成式引擎优化),llms.txt 是目前成本最低、见效最直接的一个技术动作。 它就像给 AI 大模型递上一张"内容地图"——主动告诉它:我这个站有哪些内容、都在讲什么、怎么获取完整版。做了,你的内容更容易被 AI 检索和引用;不做,AI 只能自己摸索。
如果你在做 GEO(生成式引擎优化),llms.txt 是目前成本最低、见效最直接的一个技术动作。
它就像给 AI 大模型递上一张"内容地图"——主动告诉它:我这个站有哪些内容、都在讲什么、怎么获取完整版。做了,你的内容更容易被 AI 检索和引用;不做,AI 只能自己摸索。
本文从概念到落地,手把手教你配置 llms.txt,附完整代码示例和验证方法。
一、llms.txt 是什么
llms.txt 是一个放在网站根目录的纯文本文件,用于向 AI 大模型(LLM)说明站点的结构与内容索引。
它由 Jeremy Howard(Answer.AI 创始人)在 2024 年提出,格式类似 SEO 时代的 robots.txt 和 sitemap.xml,但服务对象是 AI:
robots.txt:告诉爬虫什么不要抓sitemap.xml:告诉搜索引擎有哪些页面llms.txt:告诉 AI 有哪些内容、讲什么、怎么读最合适
标准格式以 Markdown 书写,包含站点简介 + 分类内容列表。
二、为什么要有 llms.txt
AI 在联网检索时,面临一个实际问题:网页里塞满了导航栏、广告、脚本、页脚,真正的正文被淹没。 这带来两个后果:
- 抓取成本高,AI 可能放弃或只抓到噪音
- 内容再多,AI 也不容易判断"哪篇讲什么主题"
llms.txt 解决的就是这个——用结构化的方式,把站点最有价值的内容清晰呈现给 AI。
对比一下效益:
| 不做 llms.txt | 做了 llms.txt |
|---|---|
| AI 自己爬,抓到大量噪音 | 明确提供内容索引,信噪比高 |
| 不知道哪篇最相关 | 每篇带一句话描述,语义明确 |
| 内容可能被漏掉 | 主动声明,覆盖更全 |
三、llms.txt 的标准格式
结构很简单,分三部分:
# 站点名称
> 一句话站点简介(会作为 AI 理解站点的第一印象)
补充说明(可选,告诉 AI 如何获取完整内容)
## 分类名称 1
- [页面标题](URL) - 页面描述
## 分类名称 2
- [页面标题](URL) - 页面描述
## Optional
- [RSS](URL)
- [Sitemap](URL)
关键规则:
- 第一行
# 站点名:一级标题 - 第二行
> 简介:引用块,建议 1–2 句 - 分类用
##,条目用- [标题](链接) - 描述 ## Optional段放次要链接(RSS、Sitemap 等)- 文件放网站根目录,路径固定为
/llms.txt
四、完整示例(可直接套用)
下面是一个实际可用的模板,把方括号内容换成你自己的:
# 你的站点名称
> 一句话说清你的站是什么、提供什么价值。
本站提供 AI 与 LLM 工具可读的公开内容。完整内容请查阅 `/llms-full.txt`。
在任意页面 URL 后加 `.md` 可获取 Markdown 格式内容。
## 核心页面
- [关于我们](https://example.com/about.md) - 站点定位、团队背景与内容方向说明
- [产品服务](https://example.com/services.md) - 提供的主要服务与适用场景
## 文章
- [文章标题一](https://example.com/post-1.md) - 这篇文章解决什么问题、覆盖哪些要点
- [文章标题二](https://example.com/post-2.md) - 这篇文章解决什么问题、覆盖哪些要点
## Optional
- [RSS Feed](https://example.com/rss/)
- [Sitemap](https://example.com/sitemap.xml)
- [完整内容](https://example.com/llms-full.txt)
五、进阶:llms-full.txt
如果你想更彻底,可以再提供一个 llms-full.txt——把所有内容完整拼接在一个文件里。
区别:
| 文件 | 内容 | 用途 |
|---|---|---|
llms.txt |
索引 + 描述 | 让 AI 知道有什么 |
llms-full.txt |
全部正文 | 让 AI 一次拿到所有内容 |
llms-full.txt 的价值:AI 无需逐个抓取页面,一次性获得完整语料,大幅降低抓取成本,提升被采信的概率。适合内容量中等(几十篇以内)的站点。
六、怎么生成和管理
方式一:CMS 自动生成(推荐)
部分现代 CMS 已原生支持。以 Ghost 为例,站点只要正常发布内容,就会自动输出:
/llms.txt/llms-full.txt- 任意页面 URL 加
.md返回 Markdown
本文所在的站点就是这样做的一个实例——你可以直接访问下面的地址对照查看:
https://aigeo.macjc.cn/llms.txt(内容索引)https://aigeo.macjc.cn/llms-full.txt(完整内容)https://aigeo.macjc.cn/about.md(单页 Markdown)
方式二:手动编写
如果是自建站或 CMS 不支持,手动创建一个静态文件即可:
- 在站点根目录新建
llms.txt - 按上文格式填入内容
- 确保可通过
https://你的域名/llms.txt访问 - 内容更新时同步维护
方式三:程序动态生成
内容多的站点,可写脚本根据数据库自动生成,随内容发布实时更新。
七、如何验证配置成功
三步确认:
第一步:浏览器直接访问
打开 https://你的域名/llms.txt,能看到内容即成功。
第二步:检查 Content-Type
用命令行验证 MIME 类型(影响 AI 是否按文本正确解析):
curl -I https://你的域名/llms.txt
理想返回应为 text/plain 或 text/markdown。
第三步:检查 AI 爬虫是否可访问
确认 robots.txt 没有误挡 AI 爬虫(如 GPTBot、ClaudeBot 等),且 llms.txt 本身可被公开访问。
八、响应头声明(加分项)
更规范的做法是在 HTTP 响应头里声明 llms.txt 的存在:
Link: </llms.txt>; rel="llms-txt", </llms-full.txt>; rel="llms-full-txt"
这样 AI 工具在抓取任意页面时,就能"顺藤摸瓜"发现你的 llms.txt。nginx 配置示例:
add_header Link '</llms.txt>; rel="llms-txt", </llms-full.txt>; rel="llms-full-txt"';
九、常见问题 FAQ
Q1:llms.txt 是官方标准吗?
不是 W3C 级别的强制标准,而是社区提出、被越来越多 AI 工具采纳的约定。OpenAI、Anthropic 等均有相关讨论,采纳度在提升。做了不亏,不做也不影响基础抓取。
Q2:做了 llms.txt 就一定会被引用吗?
不一定。它是"降低 AI 获取成本"的手段,能提高概率,但最终仍取决于内容质量。内容不行,索引做得再好也没用。
Q3:llms.txt 和 sitemap.xml 冲突吗?
不冲突,互补。sitemap 服务搜索引擎,llms.txt 服务 AI。建议两个都做。
Q4:内容更新了,llms.txt 要改吗?
要。手动维护的话,每次发新文/改标题都要同步更新索引。用 CMS 自动生成的则无需操心。
Q5:小网站值得做吗?
值得。小站内容少,做一次 llms.txt 成本极低,而且能让有限的优质内容被 AI 更完整地看到,性价比很高。
Q6:.md 输出必须做吗?
强烈建议。AI 拿到纯 Markdown 比解析 HTML 高效得多,能显著提升内容被完整读取的概率。
相关阅读
本文由 AiGseo 优化平台原创,最后更新于 2026 年 9 月。

鄂公网安备42010502001286号