Главная / Блог / Нейросети

llms.txt: что это за файл и нужен ли он вашему сайту

Максим Орехов ·опубликовано 17 сентября 2026 ·13 мин чтения

Коротко: сделать его несложно, вреда он не принесёт, но и пользы пока никто не доказал. Google прямым текстом пишет, что не использует такие файлы. Ни один крупный ИИ-сервис поддержку не документирует.

Мы решили проверить это на своих данных: посмотрели, кто запрашивал llms.txt у нашего сайта за две недели, и обошли 39 известных сайтов, чтобы понять, у кого он вообще стоит. Результаты ниже, они любопытные.

Что такое llms.txt

Это текстовый файл в корне сайта, написанный на Markdown. Его задача: дать языковым моделям и ИИ-агентам короткую понятную карту сайта: что это за проект, какие страницы важны и о чём они.

Предложение опубликовал Джереми Ховард 3 сентября 2024 года на llmstxt.org. Идея простая: модели плохо разбирают HTML с меню, баннерами и скриптами, поэтому им стоит дать выжимку в чистом виде. В августе 2026 года вышла вторая версия спецификации, собранная по опыту двух лет.

Статус у него такой: предложение, а не стандарт. Поддерживать его никто не обязан, и официально никто не обещал.

Как он устроен

По спецификации в файле есть:

  • заголовок первого уровня с названием проекта — единственный обязательный элемент;
  • блок цитаты с коротким описанием: чем занимается компания или сервис;
  • разделы второго уровня со списками ссылок в формате «ссылка с названием, потом описание через двоеточие»;
  • раздел Optional — по договорённости туда кладут второстепенное, которое модель вправе пропустить.

Рядом со спецификацией живут две смежные идеи. Первая: `llms-full.txt`, где вся документация свалена в один большой файл. Вторая: отдавать Markdown-версии обычных страниц по адресу с расширением `.md` и указывать на них в коде страницы.

Выглядит это буквально так: заголовок, описание, разделы, списки ссылок с пояснениями. Ничего сложнее обычного текста.

Как выглядит живой файл

Проще всего понять на примере. Вот структура файла одного крупного российского сервиса, который мы открыли во время замера: сначала заголовок с названием компании, следом абзац-описание в виде цитаты — чем занимается и для кого. Дальше раздел «Продукты», и в нём десятки строк вида «ссылка на страницу продукта, а после двоеточия — предложение о том, что это за продукт».

На выходе получается нечто среднее между оглавлением и описанием каталога. Человеку такой файл читать скучно, а модели удобно: весь смысл сайта на одном экране, без меню, баннеров и скриптов.

Размеры при этом разные. У сервисов с документацией файл разрастается до десятков и сотен килобайт, у компаний попроще укладывается в пару страниц текста. Спецификация объёма не ограничивает, но смысл теряется, когда карта превращается в свалку всех страниц подряд.

Чем llms.txt отличается от robots.txt и sitemap.xml

Файлы стоят рядом в корне сайта, но задачи у них разные.

robots.txt отвечает за запреты и разрешения: кому из роботов куда можно. Его соблюдают все крупные краулеры, включая роботов ИИ-сервисов.

sitemap.xml — это список адресов для индексации. Его поисковики читают и используют.

llms.txt — попытка объяснить машине смысл сайта словами. Никаких инструкций он не содержит, доступ ничего не меняет, и чтение его никем не гарантировано.

Главное отсюда: llms.txt ничего не заменяет. Если у вас криво настроен robots.txt и ИИ-робот закрыт — файл ситуацию не спасёт.

Что говорят поисковики

Google. В справке по ИИ-функциям, обновлённой 15 июня 2026 года, сказано прямо: не нужно создавать новые машиночитаемые файлы, ИИ-текстовые файлы, разметку или Markdown, чтобы появляться в Поиске, включая генеративные функции. Сотрудники Google повторяли это публично, а Джон Мюллер сравнил идею с мета-тегом keywords — сигналом, от которого поиск отказался, потому что владелец сайта заполняет его сам и легко им манипулирует.

Яндекс. В справке про Алису AI ни llms.txt, ни похожие файлы не упоминаются. Условия попадания в источники там другие: высокие позиции в поиске и качественный контент.

ИИ-сервисы. Ни OpenAI, ни Anthropic, ни Perplexity не документируют чтение этого файла. При этом их роботы обычной выдачей и сайтами пользуются активно.

Кто уже поставил файл: наш замер

17 сентября 2026 года мы обошли 39 известных сайтов и проверили, отдают ли они llms.txt. Шесть не ответили: блокировка или редирект. Из оставшихся 33 файл нашёлся у 15.

Есть. Из российских — Контур, Битрикс24, Mindbox, Roistat, Retail Rocket, Нетология, МойСклад. Из зарубежных — Stripe, документация Anthropic, Cloudflare, Vercel, Zapier, Supabase, Mintlify.

Нет. Яндекс, ВКонтакте, Авито, vc.ru, Хабр, Skillbox, Практикум, eLama, ppc.world, Тильда, InSales, Unisender, Callibri, amoCRM, GetCourse, Sostav.

Полный список с размерами файлов:

Сайтllms.txtРазмер
kontur.ruесть41 КБ
bitrix24.ruесть11 КБ
mindbox.ruесть9,7 КБ
roistat.comесть192 КБ
retailrocket.ruесть31 КБ
netology.ruесть355 КБ
moysklad.ruесть38 КБ
stripe.comесть68 КБ
docs.stripe.comесть89 КБ
docs.anthropic.comесть66 КБ
cloudflare.comесть17 КБ
vercel.comесть4,6 КБ
zapier.comесть12 КБ
supabase.comесть2,6 КБ
mintlify.comесть6,2 КБ
yandex.ruнет
vk.comнет
avito.ruнет
vc.ruнет
habr.comнет
sostav.ruнет
skillbox.ruнет
practicum.yandex.ruнет
elama.ruнет
ppc.worldнет
tilda.ccнет
insales.ruнет
unisender.comнет
callibri.ruнет
amocrm.ruнет
getcourse.ruнет
anthropic.com (корень)нет
developers.sber.ruнет

Шесть сайтов в выборке не ответили и в подсчёт не вошли: Ozon, Wildberries, Т-Банк, OpenAI, Perplexity и GigaChat — блокировка или редирект.

Закономерность видна невооружённым глазом: файл ставят сервисы с большой документацией и продуктовыми страницами — там, где есть что структурировать. Контент-площадки и маркетплейсы почти поголовно обходятся без него.

Ещё наблюдение из того же обхода: у одного крупного российского сервиса в файле ссылки оформлены с лишним пробелом между скобками, из-за чего Markdown их не собирает. Файл есть, а ссылки в нём формально сломаны. Если делаете, откройте файл глазами: ссылки должны собираться в ссылки.

Что показали наши логи

Самое интересное. У нашего сайта llms.txt нет, и мы посмотрели, кто его вообще спрашивал.

За 15 дней в логах семь запросов к `/llms.txt` и три к `/ai.txt` — все получили 404. Запрашивали:

  • SEO-сканер SEOJuice — четыре раза;
  • краулер PipericBot — два раза;
  • запросы через curl и с браузерными user-agent — остальные.

Ни одного запроса от роботов OpenAI, Anthropic, Perplexity или Google. Для сравнения: в том же разборе логов мы насчитали 731 обращение с подтверждённых диапазонов ИИ-сервисов к обычным страницам сайта за девять дней. То есть роботы к нам ходят активно, просто читают статьи, а не карту для моделей.

Две эти цифры и есть ответ на вопрос статьи. Сегодня llms.txt интересует в основном аудиторские сервисы, которые проверяют наличие файла, и людей, которые смотрят, как сделано у других.

Как проверить, читает ли кто-нибудь ваш файл

Проверка занимает пять минут и отвечает на вопрос лучше любых статей, включая эту.

Загляните в логи сервера. Найдите запросы к `/llms.txt` и посмотрите на три вещи: какой user-agent, какой IP и какой код ответа. Мы сделали ровно это, и картина оказалась неожиданной: файл спрашивали SEO-сканеры и curl, а не нейросети.

Не верьте user-agent на слово. Представиться роботом OpenAI способен кто угодно. Настоящих роботов отличают по IP: у OpenAI, Anthropic и Perplexity опубликованы диапазоны адресов, с которых они ходят. В нашем разборе логов три четверти «ИИ-роботов» оказались сканерами уязвимостей, которые лезли в служебные файлы.

Считайте только ответы 200. Запросы к несуществующему файлу дают 404 и ничего не говорят о том, нужен ли он: так робот проверяет наличие, а не читает содержимое.

Сравните с обращениями к страницам. Если роботы ИИ-сервисов активно читают ваши статьи и при этом ни разу не спросили llms.txt, вывод очевиден.

Что ещё пытаются положить в корень сайта

За последние два года появилось несколько файлов с похожей идеей, и путать их не стоит.

  • ai.txt — ещё одно предложение, которое задумывалось как правила использования контента для обучения моделей. В наших логах его спрашивали три раза, всё те же сканеры.
  • llms-full.txt — способ выложить всю документацию одним файлом. Отдельным стандартом он не считается и имеет смысл для технических сервисов.
  • Markdown-версии страниц — когда обычная страница дополнительно отдаётся в чистом Markdown, а в её коде стоит ссылка на эту версию. Из всех перечисленных идей эта выглядит самой рабочей: модель получает тот же контент, но без разметки.
  • robots.txt с правилами для ИИ-роботов — единственный файл из списка, который площадки действительно соблюдают. Именно там решается, пустите вы робота или нет.

Почему вокруг файла столько шума

Интерес растёт быстрее, чем поддержка. Запрос «llms txt» в Яндексе набирает больше тысячи показов в месяц, хотя ещё в декабре 2024 года его не искали вообще: ноль. Дальше по месяцам — восемь, сорок пять, и к лету 2026 года уже больше тысячи.

Рядом появились хвосты: «llms txt что это» — 91 показ, «llms full txt» — 105, «llms txt генератор» — 60. То есть люди уже перешли от вопроса «что это» к поиску инструмента, который соберёт файл побыстрее.

Спрос подогревают агентства: файл легко продать как «оптимизацию под нейросети». Работы на пару часов, результат нельзя ни доказать, ни опровергнуть, а звучит современно. Держите в голове две вещи: Google про такие файлы написал прямо, а роботы ИИ-сервисов их пока не запрашивают.

Так нужен он вам или нет

Короткий ответ: если у вас большая документация или каталог продуктов — сделайте, это два часа работы. Если у вас сайт услуг на двадцать страниц — не тратьте время, эффекта не будет.

Когда смысл есть:

  • у вас сотни страниц документации, и вы хотите, чтобы модель находила нужный раздел, а не гадала по HTML;
  • вы работаете с внешними разработчиками и ИИ-агентами, которые читают вашу документацию;
  • вам важно контролировать формулировки: файл позволяет самим описать, что за компания и чем занимается.

Когда смысла мало:

  • маленький сайт, где всё и так на виду;
  • вы ждёте от файла роста позиций или трафика: Google говорит прямо, что не использует его;
  • у вас закрыты в robots.txt роботы ИИ-сервисов. Тогда начинать надо с robots.txt, а не с llms.txt.

И ещё одно. Файл заполняете вы сами, значит доверия к нему у поисковых систем ровно столько же, сколько к любому самоописанию. Отсюда и сравнение Google с keywords.

Как сделать, если решили

  • Соберите структуру. Название, короткое описание компании, разделы: продукты, документация, важные статьи. Под каждой ссылкой — одно предложение, о чём страница.
  • Проверьте синтаксис Markdown. Ссылка пишется без пробела между квадратными и круглыми скобками, иначе она перестаёт быть ссылкой.
  • Кладите в корень. Адрес — `site.ru/llms.txt`, отдаваться должен как обычный текст, а не как HTML-страница с меню.
  • Не дублируйте весь сайт. Смысл файла — выжимка. Полная свалка страниц полезнее в `llms-full.txt`, если он вам вообще нужен.
  • Обновляйте вместе с сайтом. Устаревшая карта хуже, чем её отсутствие.
  • Проверьте robots.txt. Убедитесь, что роботы, которым вы хотите отдавать контент, не закрыты.

Частые вопросы

llms.txt влияет на позиции в Google или Яндексе?
Нет. Google официально заявил, что Поиск такие файлы не использует, в том числе для генеративных функций. Яндекс о них не упоминает вовсе.
Помогает ли llms.txt попасть в ответы нейросетей?
Подтверждений этому нет. Ни один крупный ИИ-сервис не документирует чтение файла. Попадание в ответы даёт другое — позиции в поиске и содержание страниц, об этом у нас отдельная статья про GEO.
Чем llms.txt отличается от llms-full.txt?
Первый — короткая карта со ссылками, второй — вся документация одним файлом. Второй имеет смысл в основном для сервисов с большой технической базой.
Может ли файл навредить?
Сам по себе нет. Навредит разве что неверная информация внутри: опишете себя неточно — модель это и процитирует.
Сколько сайтов его уже поставили?
По нашему замеру 17 сентября 2026 года — 15 из 33 ответивших крупных сайтов. Среди них почти нет контент-площадок, зато есть сервисы с документацией.
Стоит ли пользоваться генераторами llms.txt?
Генератор соберёт файл из карты сайта за минуту, и это нормальная отправная точка. Но смысл файла — отбор: в него идут важные страницы с человеческими описаниями, а не весь сайт подряд. После генератора файл стоит вычитать.
Нужно ли указывать llms.txt в robots.txt или sitemap?
Спецификация этого не требует, и поисковые системы такой ссылки не ждут. Файл просто лежит в корне и доступен по прямому адресу.
Что делать вместо llms.txt, если хочется в ответы нейросетей?
Работать над контентом и позициями: ответ в первых строках, конкретика, цифры, вопросы в подзаголовках. Проверять видимость в отчётах Search Console и Вебмастера.

Коротко

llms.txt — предложение, а не стандарт: его придумали в сентябре 2024 года, в августе 2026 обновили до второй версии, но поддержку официально не подтвердил никто. Google говорит, что не использует такие файлы, Яндекс молчит.

Наш замер показал, что файл ставят в основном сервисы с документацией: 15 сайтов из 33. А в наших логах за две недели его спрашивали семь раз, и все семь запросов пришли от сканеров и людей, а не от роботов нейросетей.

Вывод спокойный: делать имеет смысл тем, у кого много документации, и не ради трафика. Всем остальным полезнее потратить те же два часа на страницу, которая отвечает на вопрос клиента.

Хотите, чтобы вас находили и цитировали нейросети, — посмотрим ваш сайт и скажем, что чинить первым: @max_rekl.

Разберём ваш сайт по ИИ-видимости

Посмотрим, что мешает попадать в ответы нейросетей, и скажем, с чего начать: файлы тут обычно ни при чём.

Разборы без воды — в канале
Пишу про лидогенерацию на своих цифрах: что сработало, что нет и сколько стоило.
@maxneedleads →
Читайте также