Проверяем ваш llms.txt по формату и заодно смотрим, пускает ли robots.txt ботов ИИ-поиска — файл без открытого доступа бесполезен. Ниже — валидатор, генератор и честный ответ на вопрос, нужен ли вам этот файл вообще.
Проверить llms.txt
Введите домен — вытянем /llms.txt, разберём формат и проверим доступ ботов. Данные не сохраняем.
Собрать llms.txt с нуля
Заполните три поля — получите файл в правильном формате. Ссылки — по одной на строку, в виде «Название | адрес».
Что такое llms.txt и чего он не делает
Текстовый файл в корне сайта со списком главных материалов — карта для языковых моделей, предложенная Джереми Ховардом в 2024 году. Формат простой: заголовок с названием, одна фраза описания, разделы со ссылками в разметке markdown.
Чем отличается от robots.txt и sitemap.xml
robots.txt говорит, куда ботам можно, sitemap.xml перечисляет все адреса для обхода, llms.txt отвечает на третий вопрос — что на сайте главное. Первые два читают поисковые роботы по обязанности, третий — по желанию разработчика конкретной системы.
Чего он точно не делает
Не влияет на ранжирование, не заменяет структуру сайта и не заставляет систему упомянуть вас в ответе. Отбор источников для генеративного ответа идёт из поискового индекса, а не из этого файла.
Кто его читает: наш замер
17 августа 2026 года мы прогнали через этот валидатор 17 сайтов — русские конкуренты из топа выдачи по SEO-запросам, западные вендоры инструментов и несколько сайтов нашего флота. Результат: файл нашёлся у трёх.
Русская выдача
Из семи сайтов, которые держат топ по нашим запросам — habr.com, skillbox.ru, vc.ru, timeweb.com, practicum.yandex.ru, thecode.media, klerk.ru — файл есть только у netology.ru, и тот проходит проверку на 89 из 100.
Западные вендоры
Показательнее: у Ahrefs, Semrush, SE Ranking, Surfer SEO и Clearscope файла нет ни у кого. Это компании, которые сами продают инструменты для AI-оптимизации и пишут о ней статьи. Если бы llms.txt влиял на видимость в моделях, он стоял бы у них первым.
Что из этого следует
Файл стоит час работы и не мешает — поэтому мы его ставим и держим на своих сайтах и сайтах клиентов. Но покупать «настройку llms.txt» как отдельную услугу не за что: это гигиена, а не работа.
Как составить файл правильно
Порядок разделов и оформление ссылок не декоративные: разбирает файл программа, а не человек.
Обязательный минимум
Одна строка # с названием проекта. Ниже строка, начинающаяся с > — описание в одну фразу. Дальше разделы ## и под ними ссылки в формате - [Название](адрес). Всё остальное — по желанию.
Что кладут в список
Не всё подряд, а то, что вы сами считаете ответами: услуги, стандарты, документация, справочные материалы. Двадцать осмысленных ссылок работают лучше двухсот случайных — файл читается целиком, и мусор в нём разбавляет главное.
llms-full.txt
Второй файл того же формата, куда складывают полные тексты материалов, а не ссылки. Нужен единицам: если ваши страницы и так открыты для обхода, дублировать их содержимое смысла нет.
Пять ошибок, которые ловит валидатор
Файл отдаёт HTML
Самая частая: адрес перехватывает движок сайта и возвращает страницу-404 или каркас приложения. Формально код 200, фактически модель получает разметку вместо текста. Проверка ловит это по первым строкам.
Ссылки на чужие домены
Встречается, когда файл копируют у другого проекта и забывают заменить адреса. Модель уходит по ним к конкуренту.
Файл есть, а сайт закрыт
Бессмысленная, но частая пара: llms.txt лежит, а в robots.txt стоит запрет для OAI-SearchBot или PerplexityBot. Валидатор проверяет обе вещи сразу именно поэтому.
Гигантский размер
Файл на сотни килобайт не дочитывается. Если материалов много, оставьте главное, детали вынесите в llms-full.txt.
Нет описания и разделов
Плоский список ссылок без заголовка и группировки формально валиден, но теряет смысл: непонятно, чей это сайт и что на нём важнее.
Нужен ли он вам
Короткий ответ: поставьте, если это час работы, и не платите за это отдельно. Файл — часть технической гигиены наравне с sitemap.xml, но не рычаг видимости.
Когда он точно не поможет
Если сайт закрыт от ботов ИИ-поиска, страницы не в поисковом индексе или на них нет ответов на вопросы вашей ниши. Тогда работать нужно с этим, а llms.txt ничего не изменит. Порядок работ описан в стандарте GEO 1.0.
Как проверить, что вас вообще видят
Замером упоминаний: 15 контрольных вопросов ниши — те же, что в публичном индексе видимости, заданных в четырёх системах, с фиксацией ответа. Это разбирается на странице видимости в Алисе AI, а сделать такой замер под ваш сайт можно в рамках GEO-аудита.
Частые вопросы
Нет. Ни Яндекс, ни Google не используют его в ранжировании и не заявляли обратного. Это файл для языковых моделей, а не для поисковых роботов, и на выдачу он не влияет никак.
Затем же, зачем аккуратный sitemap: стоит час, не мешает, а часть систем его читает. Наш замер от 17.08.2026 показал, что из 14 профильных сайтов файл есть только у одного — значит и переоценивать его не нужно. Ставьте и идите заниматься содержанием страниц.
Столько, сколько у вас действительно главных материалов — обычно 10–30. Файл читается целиком, поэтому длинный список размывает главное. Если хочется перечислить всё, для этого есть sitemap.xml.
Адрес перехватывает движок сайта: вместо файла отдаётся страница. Чаще всего это происходит на SPA и на сайтах, где все неизвестные адреса уходят в один обработчик. Решается правилом на сервере, которое отдаёт /llms.txt как статический файл до всякой обработки.
Почти никому. Он нужен, когда содержимое страниц недоступно роботам, — например, всё отдаётся скриптом. Если страницы открыты и индексируются, дублировать их тексты в файл незачем.
Нет. Проверка идёт запросом к вашему сайту и возвращается вам, в базу ничего не пишется. Никаких персональных данных инструмент не собирает и не требует.