llms.txt 生成器

创建一个有效的 llms.txt 文件来告诉 ChatGPT、Claude、Perplexity 和其他LLM如何导航您的网站。实时预览、部分生成器、一键下载。

网站基础知识

部分

每个部分对相关链接进行分组。常见部分:文档、API、示例、指南。

先进的

llms.txt 预览


                    

文件放在哪里

  • 将文件上传到您的网站根目录,以便可以通过 https://your-site.com/llms.txt 访问该文件。
  • 为了获得更丰富的覆盖范围,还可以在 Markdown 中发布包含实际页面内容的 llms-full.txt。
  • 对每个链接使用绝对 URL,以便跟随该文件的LLM可以在没有您的域名的情况下解析它们。

什么是 llms.txt?

llms.txt 是一项提议的标准(llmstxt.org,2024),它为大型语言模型提供了一个简洁的、精心策划的网站地图 - 与 robots.txt 为搜索引擎爬虫所做的工作相同,但它是为需要推理您的内容的 AI 系统编写的。

机器可读的摘要

/llms.txt 中的单个 Markdown 文件总结了您的网站的内容并指向最重要的 URL。

降低爬虫成本

与您的网站相比,LLM的上下文窗口很小。 llms.txt 告诉他们应该关注哪里,以便他们无需抓取所有内容即可获得有关您的准确答案。

越来越多的采用

Anthropic、Cloudflare、Mintlify、Cursor 和其他主要面向 AI 的公司现在发布或使用 llms.txt 文件。

为什么 SEO 和 AI 可见性很重要

LLM 是新的推荐人。被 ChatGPT、Claude、Perplexity 和 Google AI Overviews 正确引用现在是与经典 SEO 不同的学科 - llms.txt 是您拥有的少数具体控制之一。

1 AI 答案中更高质量的引用

当LLM阅读结构良好的 llms.txt 时,他们会引用正确的页面而不是猜测。更少的幻觉 URL,更多真实的推荐流量。

2 减少“AI SEO”的歧义

与模糊的 E-E-A-T 调整不同,llms.txt 是一个带有规范的具体文件。您可以控制LLM所看到的内容,并且可以每周进行迭代。

3 先发优势

大多数网站仍然不发布 llms.txt。现在采用该标准将您的品牌定位为人工智能原生品牌,并使您领先于竞争对手。

4 补充 robots.txt、站点地图和结构化数据

llms.txt 不会取代任何内容——它添加了专门针对 AI 的新信号。将其与您现有的 SEO 堆栈一起发布。

如何发布 llms.txt

从生成器到实时文件只需四个步骤:

步骤1

填写基础信息

输入您的网站名称、一句话摘要和(可选)一段上下文。保持摘要紧凑——LLM首先浏览它。

步骤2

添加部分和链接

将相关 URL 分组到文档、API、示例等部分下。每个链接都是一个标题、一个绝对 URL 和一个说明其重要性的可选说明。

步骤3

下载文件

单击“下载”以保存 llms.txt。该文件是纯 Markdown 且易于阅读 - 您可以在部署之前在任何编辑器中查看它。

步骤4

上传到您的网站根目录

部署该文件,使其位于 https://your-site.com/llms.txt。使用 Content-Type 提供服务:text/markdown 或 text/plain。

专业提示

将 llms.txt 视为动态文档。每当您发布重要功能、发布新 API 或发布具有里程碑意义的文章时,请更新它 - 与您用于站点地图的节奏相同。

常见问题解答

关于发布 llms.txt 您需要了解的所有信息。

llms.txt 是官方网络标准吗?
它是 Jeremy Howard 于 2024 年在 llmstxt.org 上发布的拟议标准。它尚未成为 IETF/W3C RFC 的一部分,但已被 Anthropic、Cloudflare 和 Mintlify 等主要人工智能公司采用。通过是比正式批准更强烈的信号。
llms.txt 是否会替换 robots.txt 或 sitemap.xml?
不会。robots.txt 控制爬虫可以访问的内容。 sitemap.xml 列出了每个 URL。 llms.txt 是不同的——它是人工智能系统精心策划的、人工编写的摘要,需要在严格的上下文限制下推理您的网站。所有三个文件都有不同的用途,应该一起存在。
llms.txt 和 llms-full.txt 有什么区别?
llms.txt 是一个轻量级目录。 llms-full.txt 是相同的地图,但完整页面内容内联为 Markdown — 因此LLM可以回答问题,而无需任何额外的获取。较大的网站同时发布这两种内容;较小的站点可以仅从 llms.txt 开始。
今天哪些LLM实际阅读了 llms.txt?
按需获取页面的 AI 原生浏览器和代理(Anthropic 工具、带有浏览功能的 ChatGPT、Perplexity、Cursor、各种开源代理框架)已经在寻找 llms.txt。更广泛的内置训练集使用不太确定,但发布几乎不需要任何成本,并且随着采用的增长,文件变得更有价值。
我的 llms.txt 应该有多长?
足够短,可以轻松地适应LLM上下文窗口,并为实际问题留出空间。根据经验,目标是少于 5,000 个标记(大约 3,500 个单词)。优先考虑最重要的 URL;将边缘情况移至“可选”部分。
服务器应该使用什么内容类型?
text/markdown 是正确的 MIME 类型。如果您的服务器不支持 text/markdown,则 text/plain 是可接受的后备方案。不要将其作为 text/html 提供——这会让期待 Markdown 的获取器感到困惑。
我可以在我的网站的部分内容中屏蔽 LLM 吗?
这是一项不同的工作,由 robots.txt 和 LLM 特定的用户代理(GPTBot、Claude-Web、ClaudeBot、PerplexityBot 等)处理。 llms.txt 是一个积极的信号——“这里是需要关注的地方。”使用两者:robots.txt 来避免什么,llms.txt 来突出显示什么。
我需要使 llms.txt 与我的站点地图保持同步吗?
不是字面意义上的。站点地图很详尽; llms.txt 是精心策划的。仅包含LLM在解释您的网站时应优先考虑的 URL — 通常是 20 到 100 个精心挑选的条目,而不是整个 URL 空间。
发布 llms.txt 是否会损害我的 SEO?
不会。Google、Bing 和其他传统搜索引擎会忽略它。只有专门查找 /llms.txt 的 AI 系统才会读取它。没有抓取预算或排名成本。