Агентство EZY Research в начале августа поставило файл llms.txt на 83 сайта и двенадцать недель следило за логами сервера: кто заходит и как часто. Итог — краулер OpenAI прочитал файл 7 раз. Тот же краулер за то же время открыл robots.txt на тех же сайтах почти 4000 раз. Если вы читали материал про GEO и AEO и уже прикидываете, не добавить ли на сайт ещё и llms.txt — вот честная картина, прежде чем тратить на это вечер.

Чем llms.txt отличается от robots.txt

robots.txt существует больше двадцати пяти лет и решает одну задачу: разрешает или запрещает роботу сканировать конкретные страницы. llms.txt — про другое. Он ничего не запрещает, а поясняет: что за сайт, чем занимается компания и какие страницы читать в первую очередь, если у модели мало места в контексте на весь сайт целиком.

Оба файла — обычный текст в корне сайта: вашсайт.by/robots.txt и вашсайт.by/llms.txt.

Как устроен файл по спецификации

Формат придумала в 2024 году исследовательская лаборатория Answer.AI, и с тех пор он не менялся принципиально. Структура фиксированная:

  • Заголовок H1 с названием компании или сайта — единственная обязательная часть.
  • Строка-цитата (blockquote) сразу под заголовком — один абзац о том, чем вы занимаетесь и для кого.
  • Разделы H2 со списками ссылок в формате [Название страницы](адрес): короткое описание.
  • Отдельный раздел ## Optional — сюда выносят второстепенные страницы (юридические тексты, архив новостей); модель может пропустить его, если ей не хватает места.

Есть ещё вариант llms-full.txt: он содержит весь текст ключевых страниц, склеенный в один файл, вместо короткого списка ссылок. Для сайта с объёмной документацией это оправдано, для сайта из десятка страниц — нет: обычного llms.txt хватает с запасом.

Пример: начало llms.txt для кондитерской

# Капкейки от Тани

> Кондитерская в Минске: капкейки на заказ с доставкой в день обращения

## Каталог

- [Меню и цены](https://example.by/menu): актуальные цены на капкейки и торты

- [Доставка](https://example.by/delivery): зоны и стоимость доставки по Минску

## Optional

- [Публичная оферта](https://example.by/offer): условия оказания услуг

Кто на самом деле читает llms.txt — честные цифры

Вот те самые данные EZY Research за двенадцать недель на 83 сайтах:

  • OpenAI: 3990 обращений к robots.txt против 7 к llms.txt.
  • Anthropic: 3120 против 9.
  • PerplexityBot: 775 против 0 — ни разу за три месяца.
  • Meta-ExternalAgent: 172 против 193 — единственный крупный краулер, который читает llms.txt чаще, чем robots.txt.

Ещё файл открывали безымянные и неопознанные боты — 1001 раз, и живые люди — 564 раза: кто-то из любопытства заходит посмотреть, что за новый файл завели на сайте конкуренты или партнёры.

Отдельная деталь исследования: там, где файл вообще открывали, между публикацией и первым обращением в среднем проходило ноль дней. Поисковики и краулеры находят llms.txt мгновенно — с обнаружением всё в порядке. Крупные модели просто пока не встроили его чтение в свой обычный процесс работы, а используют от случая к случаю.

Так стоит ли его делать

Да, но не первым шагом. Сделать его — от силы полчаса, гораздо меньше усилий, чем переписывать тексты сайта под GEO. Meta уже читает его чаще, чем robots.txt, а значит, если стандарт приживётся у остальных крупных моделей, файл у вас будет готов заранее. И живые люди тоже иногда заходят его почитать — 564 захода на 83 сайта за три месяца это не случайность.

Но если вы ещё не сделали шаги из прошлого материала — структуру текста под цитирование, проверку robots.txt на блокировку AI-краулеров, разметку schema.org, — начните с них. Они уже сейчас влияют на то, назовёт ли вас нейросеть в ответе. Llms.txt — это на сдачу, а не вместо.

Как сделать свой llms.txt за один вечер

  1. Соберите пять-десять ключевых страниц сайта: главная, каталог или услуги, цены, контакты, частые вопросы.
  2. Напишите заголовок H1 с названием компании и одну строку-цитату под ним — чем вы занимаетесь и для кого.
  3. Сгруппируйте ссылки по смыслу под заголовками H2, например «Каталог» и «Контакты» — у каждой ссылки короткое описание после двоеточия.
  4. Второстепенные страницы вынесите в раздел ## Optional.
  5. Сохраните файл как llms.txt и загрузите в корень сайта. На конструкторе вроде Tilda или WordPress уточните у того, кто ведёт сайт технически, можно ли добавить туда произвольный файл — на части тарифов это ограничено.

Файл не сделает вас заметнее для ChatGPT уже завтра. Но когда крупные модели дозреют до массового чтения llms.txt — а судя по тому, что Meta уже читает его чаще robots.txt, дело именно во времени, — у вас он будет готов заранее, а не в последнюю очередь.

Отдельный вопрос — как вообще понять, замечают ли вас нейросети сейчас, без гадания по логам сервера. У Яндекса и Google для этого весной и летом 2026 года появились официальные бесплатные отчёты — разберём отдельно, что они показывают и чем дополняют друг друга.

llms.txt — история про то, чтобы нейросеть правильно рассказала о вас другим. Если же хотите, чтобы нейросеть напрямую отвечала вашим клиентам в Telegram, пока вы спите, — собрали инструкцию, как подключить такого бота без программиста.


Источники:

  • Исследование EZY Research: логи 83 сайтов за 12 недель, сколько раз каждый краулер читал llms.txt против robots.txt — ezy.ai
  • Спецификация формата llms.txt (Answer.AI) — llmstxt.org, первый анонс формата — answer.ai
  • Разбор, какие ИИ подтвердили поддержку llms.txt, а какие нет — dev.to