Коротко: сделать его несложно, вреда он не принесёт, но и пользы пока никто не доказал. Google прямым текстом пишет, что не использует такие файлы. Ни один крупный ИИ-сервис поддержку не документирует.
Мы решили проверить это на своих данных: посмотрели, кто запрашивал llms.txt у нашего сайта за две недели, и обошли 39 известных сайтов, чтобы понять, у кого он вообще стоит. Результаты ниже, они любопытные.
Что такое llms.txt
Это текстовый файл в корне сайта, написанный на Markdown. Его задача: дать языковым моделям и ИИ-агентам короткую понятную карту сайта: что это за проект, какие страницы важны и о чём они.
Предложение опубликовал Джереми Ховард 3 сентября 2024 года на llmstxt.org. Идея простая: модели плохо разбирают HTML с меню, баннерами и скриптами, поэтому им стоит дать выжимку в чистом виде. В августе 2026 года вышла вторая версия спецификации, собранная по опыту двух лет.
Статус у него такой: предложение, а не стандарт. Поддерживать его никто не обязан, и официально никто не обещал.
Как он устроен
По спецификации в файле есть:
- заголовок первого уровня с названием проекта — единственный обязательный элемент;
- блок цитаты с коротким описанием: чем занимается компания или сервис;
- разделы второго уровня со списками ссылок в формате «ссылка с названием, потом описание через двоеточие»;
- раздел Optional — по договорённости туда кладут второстепенное, которое модель вправе пропустить.
Рядом со спецификацией живут две смежные идеи. Первая: `llms-full.txt`, где вся документация свалена в один большой файл. Вторая: отдавать Markdown-версии обычных страниц по адресу с расширением `.md` и указывать на них в коде страницы.
Выглядит это буквально так: заголовок, описание, разделы, списки ссылок с пояснениями. Ничего сложнее обычного текста.
Как выглядит живой файл
Проще всего понять на примере. Вот структура файла одного крупного российского сервиса, который мы открыли во время замера: сначала заголовок с названием компании, следом абзац-описание в виде цитаты — чем занимается и для кого. Дальше раздел «Продукты», и в нём десятки строк вида «ссылка на страницу продукта, а после двоеточия — предложение о том, что это за продукт».
На выходе получается нечто среднее между оглавлением и описанием каталога. Человеку такой файл читать скучно, а модели удобно: весь смысл сайта на одном экране, без меню, баннеров и скриптов.
Размеры при этом разные. У сервисов с документацией файл разрастается до десятков и сотен килобайт, у компаний попроще укладывается в пару страниц текста. Спецификация объёма не ограничивает, но смысл теряется, когда карта превращается в свалку всех страниц подряд.
Чем llms.txt отличается от robots.txt и sitemap.xml
Файлы стоят рядом в корне сайта, но задачи у них разные.
robots.txt отвечает за запреты и разрешения: кому из роботов куда можно. Его соблюдают все крупные краулеры, включая роботов ИИ-сервисов.
sitemap.xml — это список адресов для индексации. Его поисковики читают и используют.
llms.txt — попытка объяснить машине смысл сайта словами. Никаких инструкций он не содержит, доступ ничего не меняет, и чтение его никем не гарантировано.
Главное отсюда: llms.txt ничего не заменяет. Если у вас криво настроен robots.txt и ИИ-робот закрыт — файл ситуацию не спасёт.
Что говорят поисковики
Google. В справке по ИИ-функциям, обновлённой 15 июня 2026 года, сказано прямо: не нужно создавать новые машиночитаемые файлы, ИИ-текстовые файлы, разметку или Markdown, чтобы появляться в Поиске, включая генеративные функции. Сотрудники Google повторяли это публично, а Джон Мюллер сравнил идею с мета-тегом keywords — сигналом, от которого поиск отказался, потому что владелец сайта заполняет его сам и легко им манипулирует.
Яндекс. В справке про Алису AI ни llms.txt, ни похожие файлы не упоминаются. Условия попадания в источники там другие: высокие позиции в поиске и качественный контент.
ИИ-сервисы. Ни OpenAI, ни Anthropic, ни Perplexity не документируют чтение этого файла. При этом их роботы обычной выдачей и сайтами пользуются активно.
Кто уже поставил файл: наш замер
17 сентября 2026 года мы обошли 39 известных сайтов и проверили, отдают ли они llms.txt. Шесть не ответили: блокировка или редирект. Из оставшихся 33 файл нашёлся у 15.
Есть. Из российских — Контур, Битрикс24, Mindbox, Roistat, Retail Rocket, Нетология, МойСклад. Из зарубежных — Stripe, документация Anthropic, Cloudflare, Vercel, Zapier, Supabase, Mintlify.
Нет. Яндекс, ВКонтакте, Авито, vc.ru, Хабр, Skillbox, Практикум, eLama, ppc.world, Тильда, InSales, Unisender, Callibri, amoCRM, GetCourse, Sostav.
Полный список с размерами файлов:
| Сайт | llms.txt | Размер |
|---|---|---|
| kontur.ru | есть | 41 КБ |
| bitrix24.ru | есть | 11 КБ |
| mindbox.ru | есть | 9,7 КБ |
| roistat.com | есть | 192 КБ |
| retailrocket.ru | есть | 31 КБ |
| netology.ru | есть | 355 КБ |
| moysklad.ru | есть | 38 КБ |
| stripe.com | есть | 68 КБ |
| docs.stripe.com | есть | 89 КБ |
| docs.anthropic.com | есть | 66 КБ |
| cloudflare.com | есть | 17 КБ |
| vercel.com | есть | 4,6 КБ |
| zapier.com | есть | 12 КБ |
| supabase.com | есть | 2,6 КБ |
| mintlify.com | есть | 6,2 КБ |
| yandex.ru | нет | — |
| vk.com | нет | — |
| avito.ru | нет | — |
| vc.ru | нет | — |
| habr.com | нет | — |
| sostav.ru | нет | — |
| skillbox.ru | нет | — |
| practicum.yandex.ru | нет | — |
| elama.ru | нет | — |
| ppc.world | нет | — |
| tilda.cc | нет | — |
| insales.ru | нет | — |
| unisender.com | нет | — |
| callibri.ru | нет | — |
| amocrm.ru | нет | — |
| getcourse.ru | нет | — |
| anthropic.com (корень) | нет | — |
| developers.sber.ru | нет | — |
Шесть сайтов в выборке не ответили и в подсчёт не вошли: Ozon, Wildberries, Т-Банк, OpenAI, Perplexity и GigaChat — блокировка или редирект.
Закономерность видна невооружённым глазом: файл ставят сервисы с большой документацией и продуктовыми страницами — там, где есть что структурировать. Контент-площадки и маркетплейсы почти поголовно обходятся без него.
Ещё наблюдение из того же обхода: у одного крупного российского сервиса в файле ссылки оформлены с лишним пробелом между скобками, из-за чего Markdown их не собирает. Файл есть, а ссылки в нём формально сломаны. Если делаете, откройте файл глазами: ссылки должны собираться в ссылки.
Что показали наши логи
Самое интересное. У нашего сайта llms.txt нет, и мы посмотрели, кто его вообще спрашивал.
За 15 дней в логах семь запросов к `/llms.txt` и три к `/ai.txt` — все получили 404. Запрашивали:
- SEO-сканер SEOJuice — четыре раза;
- краулер PipericBot — два раза;
- запросы через curl и с браузерными user-agent — остальные.
Ни одного запроса от роботов OpenAI, Anthropic, Perplexity или Google. Для сравнения: в том же разборе логов мы насчитали 731 обращение с подтверждённых диапазонов ИИ-сервисов к обычным страницам сайта за девять дней. То есть роботы к нам ходят активно, просто читают статьи, а не карту для моделей.
Две эти цифры и есть ответ на вопрос статьи. Сегодня llms.txt интересует в основном аудиторские сервисы, которые проверяют наличие файла, и людей, которые смотрят, как сделано у других.
Как проверить, читает ли кто-нибудь ваш файл
Проверка занимает пять минут и отвечает на вопрос лучше любых статей, включая эту.
Загляните в логи сервера. Найдите запросы к `/llms.txt` и посмотрите на три вещи: какой user-agent, какой IP и какой код ответа. Мы сделали ровно это, и картина оказалась неожиданной: файл спрашивали SEO-сканеры и curl, а не нейросети.
Не верьте user-agent на слово. Представиться роботом OpenAI способен кто угодно. Настоящих роботов отличают по IP: у OpenAI, Anthropic и Perplexity опубликованы диапазоны адресов, с которых они ходят. В нашем разборе логов три четверти «ИИ-роботов» оказались сканерами уязвимостей, которые лезли в служебные файлы.
Считайте только ответы 200. Запросы к несуществующему файлу дают 404 и ничего не говорят о том, нужен ли он: так робот проверяет наличие, а не читает содержимое.
Сравните с обращениями к страницам. Если роботы ИИ-сервисов активно читают ваши статьи и при этом ни разу не спросили llms.txt, вывод очевиден.
Что ещё пытаются положить в корень сайта
За последние два года появилось несколько файлов с похожей идеей, и путать их не стоит.
- ai.txt — ещё одно предложение, которое задумывалось как правила использования контента для обучения моделей. В наших логах его спрашивали три раза, всё те же сканеры.
- llms-full.txt — способ выложить всю документацию одним файлом. Отдельным стандартом он не считается и имеет смысл для технических сервисов.
- Markdown-версии страниц — когда обычная страница дополнительно отдаётся в чистом Markdown, а в её коде стоит ссылка на эту версию. Из всех перечисленных идей эта выглядит самой рабочей: модель получает тот же контент, но без разметки.
- robots.txt с правилами для ИИ-роботов — единственный файл из списка, который площадки действительно соблюдают. Именно там решается, пустите вы робота или нет.
Почему вокруг файла столько шума
Интерес растёт быстрее, чем поддержка. Запрос «llms txt» в Яндексе набирает больше тысячи показов в месяц, хотя ещё в декабре 2024 года его не искали вообще: ноль. Дальше по месяцам — восемь, сорок пять, и к лету 2026 года уже больше тысячи.
Рядом появились хвосты: «llms txt что это» — 91 показ, «llms full txt» — 105, «llms txt генератор» — 60. То есть люди уже перешли от вопроса «что это» к поиску инструмента, который соберёт файл побыстрее.
Спрос подогревают агентства: файл легко продать как «оптимизацию под нейросети». Работы на пару часов, результат нельзя ни доказать, ни опровергнуть, а звучит современно. Держите в голове две вещи: Google про такие файлы написал прямо, а роботы ИИ-сервисов их пока не запрашивают.
Так нужен он вам или нет
Короткий ответ: если у вас большая документация или каталог продуктов — сделайте, это два часа работы. Если у вас сайт услуг на двадцать страниц — не тратьте время, эффекта не будет.
Когда смысл есть:
- у вас сотни страниц документации, и вы хотите, чтобы модель находила нужный раздел, а не гадала по HTML;
- вы работаете с внешними разработчиками и ИИ-агентами, которые читают вашу документацию;
- вам важно контролировать формулировки: файл позволяет самим описать, что за компания и чем занимается.
Когда смысла мало:
- маленький сайт, где всё и так на виду;
- вы ждёте от файла роста позиций или трафика: Google говорит прямо, что не использует его;
- у вас закрыты в robots.txt роботы ИИ-сервисов. Тогда начинать надо с robots.txt, а не с llms.txt.
И ещё одно. Файл заполняете вы сами, значит доверия к нему у поисковых систем ровно столько же, сколько к любому самоописанию. Отсюда и сравнение Google с keywords.
Как сделать, если решили
- Соберите структуру. Название, короткое описание компании, разделы: продукты, документация, важные статьи. Под каждой ссылкой — одно предложение, о чём страница.
- Проверьте синтаксис Markdown. Ссылка пишется без пробела между квадратными и круглыми скобками, иначе она перестаёт быть ссылкой.
- Кладите в корень. Адрес — `site.ru/llms.txt`, отдаваться должен как обычный текст, а не как HTML-страница с меню.
- Не дублируйте весь сайт. Смысл файла — выжимка. Полная свалка страниц полезнее в `llms-full.txt`, если он вам вообще нужен.
- Обновляйте вместе с сайтом. Устаревшая карта хуже, чем её отсутствие.
- Проверьте robots.txt. Убедитесь, что роботы, которым вы хотите отдавать контент, не закрыты.
Частые вопросы
Коротко
llms.txt — предложение, а не стандарт: его придумали в сентябре 2024 года, в августе 2026 обновили до второй версии, но поддержку официально не подтвердил никто. Google говорит, что не использует такие файлы, Яндекс молчит.
Наш замер показал, что файл ставят в основном сервисы с документацией: 15 сайтов из 33. А в наших логах за две недели его спрашивали семь раз, и все семь запросов пришли от сканеров и людей, а не от роботов нейросетей.
Вывод спокойный: делать имеет смысл тем, у кого много документации, и не ради трафика. Всем остальным полезнее потратить те же два часа на страницу, которая отвечает на вопрос клиента.
Хотите, чтобы вас находили и цитировали нейросети, — посмотрим ваш сайт и скажем, что чинить первым: @max_rekl.