llms.txt 和 llms-full.txt 不是二选一,也不是新旧版本的关系。前者是一张供 AI 阅读的地图:用链接配合一句说明,告诉语言模型你的网站在做什么、重点在哪里;后者则像一本完整的书:把所有希望被引用的内容整理到一个纯文本文件中,让模型一次读完。把两者混为一谈,例如把全文塞进 llms.txt,或把 llms-full.txt 当作站点地图,是我们在审查项目时最常见的无效投入。
地图与整本书:两个文件最根本的分工
llms.txt 由 Jeremy Howard(Answer.AI)于 2024 年九月提出。它是一个放在网站根目录下的 Markdown 文件,URL 固定为“你的域名/llms.txt”。它的作用不是承载内容本身,而是建立索引。模型的上下文窗口有限,无法读完网站中杂乱的 HTML、导航栏、广告和跟踪代码;llms.txt 则用清晰的结构告诉模型:这个网站提供什么、哪些页面最重要,以及每个页面讲什么。你可以把它理解为专门写给机器看的目录页。
llms-full.txt(位于“你的域名/llms-full.txt”)走的是另一条路线:它会把所有希望 AI 吸收的页面——通常包括产品文档、API 说明、教程和知识库——转换成 Markdown,再串成一个连续文件。模型或智能体抓取这个文件,就相当于一次读完整套文档,无须逐页爬取,也不用逐页清理 HTML。当用户把你的域名交给 ChatGPT 或 Perplexity,或智能体需要引用你的说明时,这个文件往往是最容易直接利用的内容来源。它解决的是“一次提供完整内容”,而不是“帮我导航”。
- 用途:llms.txt 负责“发现与导航”,llms-full.txt 负责“完整读取”。
- 内容:前者由链接和说明组成,后者收录页面全文。
- 体量:前者通常只有几 KB,后者可能达到数百 KB,甚至更大。
- 更新频率:前者结构稳定、变动较少;后者则应在内容每次更新后重新生成。
- 适用对象:前者适合各类网站;后者对“拥有大量文档或知识库”的产品更具投入价值。
llms.txt 应该放什么
llms.txt 有一套约定俗成的格式,遵循这套格式更便于模型解析。整个文件从上到下依次是:H1 标题(品牌或产品名称)、简介摘要,以及按版块整理的链接列表。关键在于“克制”——它需要经过筛选和编排,而不是把整份站点地图全部倒进去。链接过多,反而会稀释你真正希望获得曝光的重点页面。
- H1 标题:用一行清楚写出品牌或项目名称,例如“#你的产品名称”。
- 摘要区块:用一段简介说明网站是什么、服务哪些人。这通常是模型最先读到、也最常被引用的一句话,值得反复打磨。
- 分区链接:使用“##”划分“文档”“案例”“价格”等版块。每个链接后附上一句说明,例如“-[快速开始](https://.../quickstart):五分钟内完成首次连接。”
- 可选区块:把次要、可跳过的链接放进名为 Optional 的区块;当模型的上下文空间不足时,这一部分会优先被舍弃。
llms-full.txt 应该放什么
llms-full.txt 收录的是文档全文,但能否真正被使用,还取决于几个实操细节。首先,应使用 Markdown 而不是 HTML,以便保留标题层级、代码块和列表,让模型能够识别内容结构。其次,删除每个页面重复出现的导航栏、页脚和弹窗,只保留正文。第三,要留意文件大小:如果整个文件超过模型单次可读取的上下文长度,末尾内容就会被截断。文件较大时,除提供总目录外,建议按主题拆分成多个较小但内容完整的文件,例如 /llms-full-api.txt、/llms-full-guides.txt。多数现代文档框架都能自动生成这类文件,不要依靠手动复制粘贴——那会让文件从一开始就走向过期。

到底应该做哪一个?
并非每个网站都需要同时配置两个文件。做得更多不一定能额外加分,维护成本却实实在在。判断标准很简单:你是否拥有一批“希望 AI 完整理解并准确引用”的深度内容?如果有,llms-full.txt 值得投入;如果网站只是由少量图片型页面组成,重点就应该放在其他地方。
- 只有少量页面的营销网站:可以先做 llms.txt,甚至暂时不做,把精力放在干净的 HTML 和结构化数据上。
- 拥有产品文档、API 文档和知识库的 SaaS:两个文件都应配置,其中 llms-full.txt 的价值更高,因为 AI 在回答产品相关问题时能获得完整依据。
- 文件体量很大:用 llms.txt 作为总索引,再按主题将 llms-full.txt 拆成多个文件,避免超出上下文长度。
- 内容更新非常频繁:把 llms-full.txt 的自动生成纳入构建流程,手动维护一定会过期。
最常见的四类错误
- 把全文塞进 llms.txt:文件会变得冗长、难以解析,也失去了索引的意义。
- llms-full.txt 大到被截断:模型只能读到前半部分,后面的内容对它而言等于不存在。
- 文件已经过期:网站内容改了,文件却没有同步更新,导致模型引用错误的旧信息,比没有文件更糟。
- 用它们替代基础工作:这两个文件不能取代干净的 HTML、正确的 Schema 标记和 robots.txt 设置。它们是加分项,不是地基。
我们为客户检查这两个文件时,发现一半的问题并非格式错误,而是根本没有维护:上线当天看起来很完善,三个月后就与网站实际内容脱节。任何会被 AI 引用的文件,都必须持续更新。— Tenten GEO Audit Team
上线后如何验证与维护
文件上线只是开始。首先确认服务器以纯文本格式(text/plain 或 text/markdown)返回内容,URL 可以直接打开,并且没有被 CDN 或防火墙拦截。接着进行实际测试:把你的域名交给 ChatGPT、Perplexity 和 Claude,观察它们回答产品相关问题时,内容是否与 llms-full.txt 一致。最后,把“重新生成这两个文件”纳入固定的内容发布流程,让文件与网站同步更新。如果你想了解自己的网站在 AI 引擎眼中缺了哪一块,Tenten GEO 的 30 分钟 GEO 诊断可以一次盘点这张地图和整本书。预约链接位于 /contact。



