Какие клиенты загружают llms.txt?

Журналы запросов могут показать обращения к файлу и метки клиентов. Они не доказывают, что модель прочитала файл, использовала его или процитировала в ответе.

Последнее обновление:

Краткий ответ

Не существует проверенного полного списка продуктов, которые автоматически обнаруживают, разбирают и используют llms.txt. Наиболее убедительные общедоступные доказательства — данные журналов запросов: они показывают, что названные клиенты загружали файлы в определённой выборке, но не то, что модель делала с байтами впоследствии.

V2 допускает карту в корне источника или по более конкретному пути и определяет rel="describedby" для обнаружения. Страница также может рекламировать представление в Markdown с rel="alternate" type="text/markdown". Клиенты должны реализовать эти связи, чтобы они имели эффект.

Что измеряли журналы запросов

Ahrefs проанализировал запросы к /llms.txt на 137,210 доменах в течение 05.2026. Примерно 38,000 доменов отдавали ответ, принятый Ahrefs, но лишь 3% этих файлов получили хотя бы один запрос за месяц. Панель носит технический и SEO-ориентированный характер, поэтому её показатели не являются оценками для всего интернета.

На именованные ИИ-боты пришлось 19.5% измеренных запросов. SEO-аудиторы, обычные краулеры, инструменты профилирования и неидентифицированные клиенты вместе составили гораздо большую долю. В этой выборке Slackbot запрашивал файл чаще, чем PerplexityBot.

Какие категории клиентов загрузили файл

Именованная категория ИИДоля всех измеренных запросов
Агенты и агентная инфраструктура10.5%
Краулеры для обучения5.3%
Ассистенты ИИ2.5%
Боты извлечения для живого поиска ИИ1.1%

Клиенты с агентным поведением составили крупнейшую именованную категорию ИИ, а Claude-Code сгенерировал больше запросов, чем любой бот извлечения, ассистент или краулер обучения в наборе данных. Это делает рабочие процессы, инициированные разработчиками, вероятной аудиторией, но не подтверждает автоматическое обнаружение или поддержку всего продукта.

Поиск, обучение и посещения пользователей — разные вещи

Документация краулера OpenAI отделяет OAI-SearchBot для ChatGPT Search, GPTBot для контента, который может использоваться для обучения базовых моделей, и ChatGPT-User для определённых действий, инициированных пользователем. OpenAI сообщает, что ChatGPT-User не используется для автоматического обхода веб-сайтов и не используется для решения, появится ли контент в Search.

Это различие полезно при классификации журналов. Оно не устанавливает, что какой-либо из этих user-agent автоматически обнаруживает, разбирает или получает особое отношение к llms.txt: публичная документация не содержит такого утверждения.

Что запрос не может доказать

  • Запрос доказывает, что клиент получил ответ, но не то, что модель прочитала или сохранила его.
  • Строка user-agent является заявленной меткой и может быть подделана, если её источник не проверен.
  • Получение файла не показывает, что он повлиял на ответ, цитату, рейтинг или обучающий корпус.
  • Ручной запрос к явно указанному URL отличается от автоматического обнаружения.
  • Одна техническая выборка и один месяц не могут установить поведение всего Web.

Как измерить показатели собственного файла

  1. Записывайте запросы к каждому корневому и path-level llms.txt URL.
  2. Сохраняйте статус, временную отметку, запрошенный URL, конечный URL и строку user-agent.
  3. Проверяйте известных ботов документированным поставщиком способом, когда важна атрибуция.
  4. Разделяйте трафик людей, аудиторов, обычных краулеров, агентов, систем обучения, ассистентов и поиска.
  5. Отчитывайтесь о запросах отдельно от переходов, цитирований и последующих конверсий.

В разделе [методика мониторинга](/blog/how-to-monitor-llms-txt/) объясняются знаменатели и состояния ответа. Для разбивки измеренной категории прочитайте кто загружает llms.txt.

FAQ

Читает ли ChatGPT llms.txt?

Ни одна документация OpenAI не подтверждает автоматическое llms.txt обнаружение или особый режим. OpenAI документирует OAI-SearchBot для поиска и ChatGPT-User для некоторых посещений, инициированных пользователями. Эти роли нельзя смешивать, а запрос явного URL не доказывает поддержку продукта в целом.

Читает ли Claude файл llms.txt?

Ни одна публичная документация провайдеров не устанавливает автоматическое llms.txt обнаружения в Claude. Запись журнала может показать, что клиент получил ответ; она не показывает, что файл был разобран, сохранён или использован в ответе.

Какой user agent использует краулер llms.txt?

Не существует единого user agent для llms.txt сканеров. Каждая система ИИ использует собственную идентичность сканера (PerplexityBot, GPTBot, ClaudeBot и т. д.). llms.txt — это пассивный файл, поэтому краулеры должны явно запросить его.

Связанные страницы

Источники