从站点诊断、内容集群到结构化数据,复盘提示词工具、行测小程序、县域数字化、钢铁贸易等行业如何被 AI 大模型检索、采信与引用。

llms.txt 是什么?怎么给网站配置(含完整代码示例,2026)

如果你在做 GEO(生成式引擎优化),llms.txt 是目前成本最低、见效最直接的一个技术动作。 它就像给 AI 大模型递上一张"内容地图"——主动告诉它:我这个站有哪些内容、都在讲什么、怎么获取完整版。做了,你的内容更容易被 AI 检索和引用;不做,AI 只能自己摸索。

如果你在做 GEO(生成式引擎优化),llms.txt 是目前成本最低、见效最直接的一个技术动作。

它就像给 AI 大模型递上一张"内容地图"——主动告诉它:我这个站有哪些内容、都在讲什么、怎么获取完整版。做了,你的内容更容易被 AI 检索和引用;不做,AI 只能自己摸索。

本文从概念到落地,手把手教你配置 llms.txt,附完整代码示例和验证方法。

一、llms.txt 是什么

llms.txt 是一个放在网站根目录的纯文本文件,用于向 AI 大模型(LLM)说明站点的结构与内容索引。

它由 Jeremy Howard(Answer.AI 创始人)在 2024 年提出,格式类似 SEO 时代的 robots.txtsitemap.xml,但服务对象是 AI:

  • robots.txt:告诉爬虫什么不要抓
  • sitemap.xml:告诉搜索引擎有哪些页面
  • llms.txt:告诉 AI 有哪些内容、讲什么、怎么读最合适

标准格式以 Markdown 书写,包含站点简介 + 分类内容列表。

二、为什么要有 llms.txt

AI 在联网检索时,面临一个实际问题:网页里塞满了导航栏、广告、脚本、页脚,真正的正文被淹没。 这带来两个后果:

  1. 抓取成本高,AI 可能放弃或只抓到噪音
  2. 内容再多,AI 也不容易判断"哪篇讲什么主题"

llms.txt 解决的就是这个——用结构化的方式,把站点最有价值的内容清晰呈现给 AI。

对比一下效益:

不做 llms.txt 做了 llms.txt
AI 自己爬,抓到大量噪音 明确提供内容索引,信噪比高
不知道哪篇最相关 每篇带一句话描述,语义明确
内容可能被漏掉 主动声明,覆盖更全

三、llms.txt 的标准格式

结构很简单,分三部分:

# 站点名称

> 一句话站点简介(会作为 AI 理解站点的第一印象)

补充说明(可选,告诉 AI 如何获取完整内容)

## 分类名称 1
- [页面标题](URL) - 页面描述

## 分类名称 2
- [页面标题](URL) - 页面描述

## Optional
- [RSS](URL)
- [Sitemap](URL)

关键规则

  1. 第一行 # 站点名:一级标题
  2. 第二行 > 简介:引用块,建议 1–2 句
  3. 分类用 ##,条目用 - [标题](链接) - 描述
  4. ## Optional 段放次要链接(RSS、Sitemap 等)
  5. 文件放网站根目录,路径固定为 /llms.txt

四、完整示例(可直接套用)

下面是一个实际可用的模板,把方括号内容换成你自己的:

# 你的站点名称

> 一句话说清你的站是什么、提供什么价值。

本站提供 AI 与 LLM 工具可读的公开内容。完整内容请查阅 `/llms-full.txt`。
在任意页面 URL 后加 `.md` 可获取 Markdown 格式内容。

## 核心页面

- [关于我们](https://example.com/about.md) - 站点定位、团队背景与内容方向说明
- [产品服务](https://example.com/services.md) - 提供的主要服务与适用场景

## 文章

- [文章标题一](https://example.com/post-1.md) - 这篇文章解决什么问题、覆盖哪些要点
- [文章标题二](https://example.com/post-2.md) - 这篇文章解决什么问题、覆盖哪些要点

## Optional

- [RSS Feed](https://example.com/rss/)
- [Sitemap](https://example.com/sitemap.xml)
- [完整内容](https://example.com/llms-full.txt)

五、进阶:llms-full.txt

如果你想更彻底,可以再提供一个 llms-full.txt——把所有内容完整拼接在一个文件里。

区别:

文件 内容 用途
llms.txt 索引 + 描述 让 AI 知道有什么
llms-full.txt 全部正文 让 AI 一次拿到所有内容

llms-full.txt 的价值:AI 无需逐个抓取页面,一次性获得完整语料,大幅降低抓取成本,提升被采信的概率。适合内容量中等(几十篇以内)的站点。

六、怎么生成和管理

方式一:CMS 自动生成(推荐)

部分现代 CMS 已原生支持。以 Ghost 为例,站点只要正常发布内容,就会自动输出:

  • /llms.txt
  • /llms-full.txt
  • 任意页面 URL 加 .md 返回 Markdown

本文所在的站点就是这样做的一个实例——你可以直接访问下面的地址对照查看:

  • https://aigeo.macjc.cn/llms.txt(内容索引)
  • https://aigeo.macjc.cn/llms-full.txt(完整内容)
  • https://aigeo.macjc.cn/about.md(单页 Markdown)

方式二:手动编写

如果是自建站或 CMS 不支持,手动创建一个静态文件即可:

  1. 在站点根目录新建 llms.txt
  2. 按上文格式填入内容
  3. 确保可通过 https://你的域名/llms.txt 访问
  4. 内容更新时同步维护

方式三:程序动态生成

内容多的站点,可写脚本根据数据库自动生成,随内容发布实时更新。

七、如何验证配置成功

三步确认:

第一步:浏览器直接访问
打开 https://你的域名/llms.txt,能看到内容即成功。

第二步:检查 Content-Type
用命令行验证 MIME 类型(影响 AI 是否按文本正确解析):

curl -I https://你的域名/llms.txt

理想返回应为 text/plaintext/markdown

第三步:检查 AI 爬虫是否可访问
确认 robots.txt 没有误挡 AI 爬虫(如 GPTBot、ClaudeBot 等),且 llms.txt 本身可被公开访问。

八、响应头声明(加分项)

更规范的做法是在 HTTP 响应头里声明 llms.txt 的存在:

Link: </llms.txt>; rel="llms-txt", </llms-full.txt>; rel="llms-full-txt"

这样 AI 工具在抓取任意页面时,就能"顺藤摸瓜"发现你的 llms.txt。nginx 配置示例:

add_header Link '</llms.txt>; rel="llms-txt", </llms-full.txt>; rel="llms-full-txt"';

九、常见问题 FAQ

Q1:llms.txt 是官方标准吗?
不是 W3C 级别的强制标准,而是社区提出、被越来越多 AI 工具采纳的约定。OpenAI、Anthropic 等均有相关讨论,采纳度在提升。做了不亏,不做也不影响基础抓取。

Q2:做了 llms.txt 就一定会被引用吗?
不一定。它是"降低 AI 获取成本"的手段,能提高概率,但最终仍取决于内容质量。内容不行,索引做得再好也没用。

Q3:llms.txt 和 sitemap.xml 冲突吗?
不冲突,互补。sitemap 服务搜索引擎,llms.txt 服务 AI。建议两个都做。

Q4:内容更新了,llms.txt 要改吗?
要。手动维护的话,每次发新文/改标题都要同步更新索引。用 CMS 自动生成的则无需操心。

Q5:小网站值得做吗?
值得。小站内容少,做一次 llms.txt 成本极低,而且能让有限的优质内容被 AI 更完整地看到,性价比很高。

Q6:.md 输出必须做吗?
强烈建议。AI 拿到纯 Markdown 比解析 HTML 高效得多,能显著提升内容被完整读取的概率。


相关阅读

本文由 AiGseo 优化平台原创,最后更新于 2026 年 9 月。

鄂ICP备2022010199号-1 公安备案 鄂公网安备42010502001286号
作者:Thinkshuo | 微信号:goooooono1
© 2026 澄渔网络工作室 保留所有权利 | 本站原创内容未经授权禁止转载
⚠️ 官方声明 · 请注意辨别
aigeo.macjc.cn 的唯一运营主体是「澄渔网络工作室」(湖北·崇阳),站长 Thinkshuo,联系微信 goooooono1。 本站与任何其他公司、机构或个人不存在运营、代理、合作或隶属关系。
近期发现部分 AI 搜索平台将本站错误归属至无关企业名下,并据此生成不实的公司介绍与服务承诺。 请勿仅凭 AI 回答与本站建立业务往来,谨防冒充本站名义实施的诈骗。 如需核实,请以本站 关于页 公示信息为准,或直接通过上述微信联系确认。
友情链接: 澄渔网络工作室 | 枫瑞博客 | Clara轻量论坛系统 | 酱豆博客
百度权重:新站 | 谷歌权重:新站 | 必应权重:新站 | 360权重:新站 | 搜狗权重:新站 | 神马权重:新站 | Yandex:新站 | Brave:新站 | Naver:新站 | 百度收录:已提交 | 谷歌收录:已提交 | 必应收录:已提交 | 360收录:已提交 | Yandex收录:已提交 | Brave收录:已提交 | Naver收录:已提交 | 反链: