Какие клиенты загружают llms.txt?
Журналы запросов могут показать обращения к файлу и метки клиентов. Они не доказывают, что модель прочитала файл, использовала его или процитировала в ответе.
Последнее обновление:
Краткий ответ
Не существует проверенного полного списка продуктов, которые автоматически обнаруживают,
разбирают и используют
llms.txt. Наиболее убедительные общедоступные доказательства — данные журналов
запросов: они показывают, что названные клиенты загружали файлы в определённой выборке, но не
то, что модель делала с байтами впоследствии.
V2 допускает карту в корне источника или по более конкретному пути и определяет
rel="describedby" для обнаружения. Страница также может рекламировать представление в
Markdown с rel="alternate" type="text/markdown". Клиенты должны реализовать эти
связи, чтобы они имели эффект.
Что измеряли журналы запросов
Ahrefs проанализировал запросы к /llms.txt на 137,210 доменах в течение 05.2026. Примерно
38,000 доменов отдавали ответ, принятый Ahrefs, но лишь 3% этих файлов получили хотя бы один запрос
за месяц. Панель носит технический и SEO-ориентированный характер, поэтому её показатели не являются
оценками для всего интернета.
На именованные ИИ-боты пришлось 19.5% измеренных запросов. SEO-аудиторы, обычные краулеры, инструменты профилирования и неидентифицированные клиенты вместе составили гораздо большую долю. В этой выборке Slackbot запрашивал файл чаще, чем PerplexityBot.
Какие категории клиентов загрузили файл
| Именованная категория ИИ | Доля всех измеренных запросов |
|---|---|
| Агенты и агентная инфраструктура | 10.5% |
| Краулеры для обучения | 5.3% |
| Ассистенты ИИ | 2.5% |
| Боты извлечения для живого поиска ИИ | 1.1% |
Клиенты с агентным поведением составили крупнейшую именованную категорию ИИ, а Claude-Code сгенерировал больше запросов, чем любой бот извлечения, ассистент или краулер обучения в наборе данных. Это делает рабочие процессы, инициированные разработчиками, вероятной аудиторией, но не подтверждает автоматическое обнаружение или поддержку всего продукта.
Поиск, обучение и посещения пользователей — разные вещи
Документация краулера OpenAI отделяет OAI-SearchBot для ChatGPT Search,
GPTBot для контента, который может использоваться для обучения базовых моделей, и
ChatGPT-User для определённых действий, инициированных пользователем. OpenAI сообщает,
что
ChatGPT-User не используется для автоматического обхода веб-сайтов и не используется
для решения, появится ли контент в Search.
Это различие полезно при классификации журналов. Оно не устанавливает, что какой-либо из этих
user-agent автоматически обнаруживает, разбирает или получает особое отношение к llms.txt: публичная документация не содержит такого утверждения.
Что запрос не может доказать
- Запрос доказывает, что клиент получил ответ, но не то, что модель прочитала или сохранила его.
- Строка user-agent является заявленной меткой и может быть подделана, если её источник не проверен.
- Получение файла не показывает, что он повлиял на ответ, цитату, рейтинг или обучающий корпус.
- Ручной запрос к явно указанному URL отличается от автоматического обнаружения.
- Одна техническая выборка и один месяц не могут установить поведение всего Web.
Как измерить показатели собственного файла
- Записывайте запросы к каждому корневому и path-level
llms.txtURL. - Сохраняйте статус, временную отметку, запрошенный URL, конечный URL и строку user-agent.
- Проверяйте известных ботов документированным поставщиком способом, когда важна атрибуция.
- Разделяйте трафик людей, аудиторов, обычных краулеров, агентов, систем обучения, ассистентов и поиска.
- Отчитывайтесь о запросах отдельно от переходов, цитирований и последующих конверсий.
В разделе [методика мониторинга](/blog/how-to-monitor-llms-txt/) объясняются знаменатели и состояния ответа. Для разбивки измеренной категории прочитайте кто загружает llms.txt.
FAQ
Читает ли ChatGPT llms.txt?
Ни одна документация OpenAI не подтверждает автоматическое llms.txt обнаружение или особый
режим. OpenAI документирует OAI-SearchBot для поиска и ChatGPT-User для
некоторых посещений, инициированных пользователями. Эти роли нельзя смешивать, а запрос явного URL
не доказывает поддержку продукта в целом.
Читает ли Claude файл llms.txt?
Ни одна публичная документация провайдеров не устанавливает автоматическое llms.txt обнаружения
в Claude. Запись журнала может показать, что клиент получил ответ; она не показывает, что файл был
разобран, сохранён или использован в ответе.
Какой user agent использует краулер llms.txt?
Не существует единого user agent для llms.txt сканеров. Каждая система ИИ использует
собственную идентичность сканера (PerplexityBot, GPTBot, ClaudeBot и т. д.). llms.txt — это пассивный файл, поэтому краулеры должны явно запросить его.
Связанные страницы
- Кто использует llms.txt, свидетельства применения в реальном мире.
- Справочник формата llms.txt, подробности спецификации.
- Как создать llms.txt, пошагово для любого стека.
- Валидатор · Генератор.