llms.txt 采用现状,2026年6月

No global census of llms.txt exists, so we built a tracker: 219 notable hosts, fetched and parsed every week. Here is what the data actually says, with the raw JSON published alongside.

最近更新:

为什么要衡量它

大多数关于 llms.txt 的文章都会引用无人能够验证的采用数字,例如“数万个网站”和“采用量暴增”,却很少提供来源,也从不说明方法。这会造成双向问题:支持者夸大这项约定,怀疑者则在同样缺乏数据的情况下否定它。

因此我们对其进行测量。不是测量整个网络(没有人能做到),而是测量一个固定且公开的网站样本,其中包含 219 个横跨八个行业的知名主机,每周自动复查。这个群组可以逐次运行比较。

跟踪器如何工作

检查器请求 https://<host>/llms.txt ,对固定样本中的每个成员执行检查、跟随重定向,并且仅在响应为 HTTP 200、内容为纯文本而不是 HTML 应用外壳,且以有效的 Markdown H1 开头时,才将主机计为提供文件;H1 是该规范唯一的硬性要求。无法访问的主机会从基数中排除,而不会计为未命中。固定样本、原始结果和检查器本身均已公开(链接见下文),因此任何人都可以审核或复现这些数字。

数据(2026-09-07)

其中 217 个已测试的主机, 122 (56.2%) 提供一个 llms.txt 文件。文件大小的中位数为 14.1 KB,并且 101 个 122 个文件包含推荐的引用块摘要。

领域 服务 / 已测试 速率
开发者工具 44 / 61 72.1%
SaaS 32 / 47 68.1%
文档平台 4 / 7 57.1%
人工智能与机器学习 20 / 36 55.6%
电子商务 7 / 13 53.8%
金融科技 8 / 16 50%
其他 5 / 23 21.7%
媒体 2 / 14 14.3%

如何阅读它们

各行业之间的差异才是真正值得关注之处。面向开发者的公司采用率很高:其用户整天都会向 AI 助手询问 API 和 SDK,因此精选文档映射拥有明确受众。媒体网站几乎完全忽略了这一约定,这与它们对 AI 抓取工具的总体态度一致:许多网站选择在 robots.txt 中阻止它们,而不是为其提供指引。

有两个诚实的提醒。第一,这个面板按设计会偏向科技公司,所以 头条比例是一个队列数字,不是全网估计;价值在于趋势和 行业对比。第二,提供这个文件并不意味着 AI 系统会读取它: Google 已表示它不使用 llms.txt,而且没有主要 提供商确认在推理时使用它。支持该文件的依据在于 范围更窄且有文档依据的效果,而不是基于已确认的流水线。

要点

  • 在知名的面向开发者的主机中,llms.txt 如今已普遍到 提供该文件,会使你成为该群组中的例外。
  • 文件大小的中位数较小(14.1 KB):采用者将其视为一张经过整理的 地图,正如规范所设想的那样。
  • 在科技领域之外,采用仍然有限。任何把 llms.txt 宣传为通用标准的人都走在了数据前面。

完整的已验证列表位于 目录,每周一重新检查。 这些数字每周会自动更新;此页面始终显示最新一次运行。

来源