Услуга · Инструменты Эко ОС

Генератор и валидатор llms.txt

Проверяем llms.txt по формату и доступ ботов ИИ-поиска в robots.txt, собираем файл с нуля. Плюс замер: из 17 профильных сайтов файл есть у трёх.

Никита Шорин 17 августа 2026 5 мин 114 просмотров 0 ♥
Г
Эко ОС · услуги · Инструменты Эко ОС

Проверяем ваш llms.txt по формату и заодно смотрим, пускает ли robots.txt ботов ИИ-поиска — файл без открытого доступа бесполезен. Ниже — валидатор, генератор и честный ответ на вопрос, нужен ли вам этот файл вообще.

Проверить llms.txt

Введите домен — вытянем /llms.txt, разберём формат и проверим доступ ботов. Данные не сохраняем.

Собрать llms.txt с нуля

Заполните три поля — получите файл в правильном формате. Ссылки — по одной на строку, в виде «Название | адрес».

Что такое llms.txt и чего он не делает

Текстовый файл в корне сайта со списком главных материалов — карта для языковых моделей, предложенная Джереми Ховардом в 2024 году. Формат простой: заголовок с названием, одна фраза описания, разделы со ссылками в разметке markdown.

Чем отличается от robots.txt и sitemap.xml

robots.txt говорит, куда ботам можно, sitemap.xml перечисляет все адреса для обхода, llms.txt отвечает на третий вопрос — что на сайте главное. Первые два читают поисковые роботы по обязанности, третий — по желанию разработчика конкретной системы.

Чего он точно не делает

Не влияет на ранжирование, не заменяет структуру сайта и не заставляет систему упомянуть вас в ответе. Отбор источников для генеративного ответа идёт из поискового индекса, а не из этого файла.

Кто его читает: наш замер

17 августа 2026 года мы прогнали через этот валидатор 17 сайтов — русские конкуренты из топа выдачи по SEO-запросам, западные вендоры инструментов и несколько сайтов нашего флота. Результат: файл нашёлся у трёх.

Русская выдача

Из семи сайтов, которые держат топ по нашим запросам — habr.com, skillbox.ru, vc.ru, timeweb.com, practicum.yandex.ru, thecode.media, klerk.ru — файл есть только у netology.ru, и тот проходит проверку на 89 из 100.

Западные вендоры

Показательнее: у Ahrefs, Semrush, SE Ranking, Surfer SEO и Clearscope файла нет ни у кого. Это компании, которые сами продают инструменты для AI-оптимизации и пишут о ней статьи. Если бы llms.txt влиял на видимость в моделях, он стоял бы у них первым.

Что из этого следует

Файл стоит час работы и не мешает — поэтому мы его ставим и держим на своих сайтах и сайтах клиентов. Но покупать «настройку llms.txt» как отдельную услугу не за что: это гигиена, а не работа.

Есть ли llms.txt у профильных сайтовllms.txtбалл проверкиeco-os.ruесть100 / 100indigo-stroy.ruесть100 / 100netology.ruесть89 / 100habr.comнетskillbox.ruнетvc.ruнетpracticum.yandex.ruнетahrefs.comнетsemrush.comнетsurferseo.comнетclearscope.ioнетЗамер 17.08.2026 этим же валидатором, 17 сайтов. Файл нашёлся у трёх.
Листайте схему вбок →
Русская выдача по SEO-запросам и западные вендоры инструментов AI-оптимизации. У продавцов AI-оптимизации файла нет.

Как составить файл правильно

Порядок разделов и оформление ссылок не декоративные: разбирает файл программа, а не человек.

Обязательный минимум

Одна строка # с названием проекта. Ниже строка, начинающаяся с > — описание в одну фразу. Дальше разделы ## и под ними ссылки в формате - [Название](адрес). Всё остальное — по желанию.

Что кладут в список

Не всё подряд, а то, что вы сами считаете ответами: услуги, стандарты, документация, справочные материалы. Двадцать осмысленных ссылок работают лучше двухсот случайных — файл читается целиком, и мусор в нём разбавляет главное.

llms-full.txt

Второй файл того же формата, куда складывают полные тексты материалов, а не ссылки. Нужен единицам: если ваши страницы и так открыты для обхода, дублировать их содержимое смысла нет.

Пять ошибок, которые ловит валидатор

Файл отдаёт HTML

Самая частая: адрес перехватывает движок сайта и возвращает страницу-404 или каркас приложения. Формально код 200, фактически модель получает разметку вместо текста. Проверка ловит это по первым строкам.

Ссылки на чужие домены

Встречается, когда файл копируют у другого проекта и забывают заменить адреса. Модель уходит по ним к конкуренту.

Файл есть, а сайт закрыт

Бессмысленная, но частая пара: llms.txt лежит, а в robots.txt стоит запрет для OAI-SearchBot или PerplexityBot. Валидатор проверяет обе вещи сразу именно поэтому.

Гигантский размер

Файл на сотни килобайт не дочитывается. Если материалов много, оставьте главное, детали вынесите в llms-full.txt.

Нет описания и разделов

Плоский список ссылок без заголовка и группировки формально валиден, но теряет смысл: непонятно, чей это сайт и что на нём важнее.

Нужен ли он вам

Короткий ответ: поставьте, если это час работы, и не платите за это отдельно. Файл — часть технической гигиены наравне с sitemap.xml, но не рычаг видимости.

Когда он точно не поможет

Если сайт закрыт от ботов ИИ-поиска, страницы не в поисковом индексе или на них нет ответов на вопросы вашей ниши. Тогда работать нужно с этим, а llms.txt ничего не изменит. Порядок работ описан в стандарте GEO 1.0.

Как проверить, что вас вообще видят

Замером упоминаний: 15 контрольных вопросов ниши — те же, что в публичном индексе видимости, заданных в четырёх системах, с фиксацией ответа. Это разбирается на странице видимости в Алисе AI, а сделать такой замер под ваш сайт можно в рамках GEO-аудита.

Частые вопросы

Нет. Ни Яндекс, ни Google не используют его в ранжировании и не заявляли обратного. Это файл для языковых моделей, а не для поисковых роботов, и на выдачу он не влияет никак.

Затем же, зачем аккуратный sitemap: стоит час, не мешает, а часть систем его читает. Наш замер от 17.08.2026 показал, что из 14 профильных сайтов файл есть только у одного — значит и переоценивать его не нужно. Ставьте и идите заниматься содержанием страниц.

Столько, сколько у вас действительно главных материалов — обычно 10–30. Файл читается целиком, поэтому длинный список размывает главное. Если хочется перечислить всё, для этого есть sitemap.xml.

Адрес перехватывает движок сайта: вместо файла отдаётся страница. Чаще всего это происходит на SPA и на сайтах, где все неизвестные адреса уходят в один обработчик. Решается правилом на сервере, которое отдаёт /llms.txt как статический файл до всякой обработки.

Почти никому. Он нужен, когда содержимое страниц недоступно роботам, — например, всё отдаётся скриптом. Если страницы открыты и индексируются, дублировать их тексты в файл незачем.

Нет. Проверка идёт запросом к вашему сайту и возвращается вам, в базу ничего не пишется. Никаких персональных данных инструмент не собирает и не требует.

Полезно? Поставьте лайк — это помогает другим найти статью.