Chrome 的 Lighthouse llms.txt 审计实际检查什么
Chrome 在 Lighthouse 中添加了 llms.txt 检查。其文档解释了服务器错误情形,而开源实现还揭示了另外三项内容检查。
最近更新:
审计做什么
Lighthouse 是集成在 Chrome DevTools 中并可作为 CLI 使用的审计工具,现在已将其 llms.txt 检查纳入代理浏览审计 。Chrome 对此的文档最后更新于 2026-05-05,将该文件描述为“一种新兴约定,用于提供网站内容的机器可读摘要,专为 LLM 和 AI 代理设计”,并给出一个理由:“没有这个文件,代理可能需要花更多时间抓取网站,才能理解其高层结构和主要内容。”
这是关于代理抓取效率的论点,而不是可见性或排名的论点。这与我们在llms.txt 与 SEO以及Google 是否使用 llms.txt中的记录一致:这里没有任何内容声称能带来搜索收益。
开源审计实现补充了简短文档页面省略的细节。请求成功时,Lighthouse 会检查正文至少有 50 个字符、包含 H1 标题和 Markdown 链接。这些是有用的冒烟测试,并不是 llms.txt v2 语法的完整实现。
不适用不等于失败
这一部分经常被错误报道。文档说服务器错误会被标记,而缺失文件会被标记为“不适用”,因为该约定仍然是可选的。实现将缺失文件的情况推广到任何 4xx 响应。
- 任何 4xx 响应 :不适用。审计不会根据这个文件给网站评分。
- 5xx 响应或抓取失败 :失败。
- 成功响应 :正文至少需要 50 个字符,并同时包含 H1 和 Markdown 链接。
因此,Lighthouse 不会因为网站没有 llms.txt 而惩罚它。不过,如果文件成功提供,审计确实会说明一些关于其最低内容的情况。
如果通过函数或重写来提供文件,而不是把它作为静态资源提供,服务器或抓取错误仍然是实际的失败模式。我们的各技术栈指南尽可能涵盖将它作为普通静态文件提供,验证器则执行更完整的结构分析。
它实际多久运行一次
Ahrefs 对 /llms.txt 的每个访问用户代理进行分类,范围涵盖 2026年5月 的 137,210 个域名。Chrome 的 Lighthouse 审计占其测量的全部抓取中的 22 个请求,约为每 1,000 次中的 1 次 。
作为规模参照,在同一数据集中,SEO 审计工具这一类别占请求的 21.7%,通用 Web 抓取器占 13.1%,所有具名 AI 机器人合计占 19.5%。重新点燃这场讨论的审计,在流量中只是舍入误差。
这并不是说审计不重要,而是反对把它的存在当作大规模读取这些文件的证据。它是开发者工具中的一项检查,只有开发者运行它时才会运行。
如何处理这一内容
三件事,都不紧急。
不要因为 Lighthouse “要求”就发布 llms.txt。 它并不要求,文档也明确这样说。如果收益与限制中的理由适用于你,就发布它。
检查状态和正文。 已发布文件应成功返回,包含 H1 和有用的 Markdown 链接,并且足够长,能承载有意义的内容。
单独验证完整的 v2 一致性。 Lighthouse 不检查路径范围、前言语法、部分结构、发现关系或链接健康状况。我们的验证器和部署检查覆盖的正是这一更大缺口。