Поиск с нейросетями

llms.txt: что это за файл и нужен ли он вашему сайту

Ещё говорят: llms txt, файл llms.txt, LLMs.txt, llms-full.txt

Коротко

llms.txt — текстовый файл в корне сайта, который в сжатом виде рассказывает языковым моделям, что это за сайт и какие страницы на нём главные. Формат предложил Джереми Ховард в сентябре 2024 года, спецификация лежит на llmstxt.org. Файл пишется в Markdown и читается человеком так же легко, как машиной.

Важная оговорка: ни один крупный поисковик публично не подтверждал, что учитывает llms.txt при формировании ответов. Это предложение отрасли; поисковые системы его не стандартизировали.

Какую задачу он решает

У модели ограничено окно контекста: целиком большой сайт в него не влезает, да и HTML наполовину состоит из меню, скриптов и баннеров. Идея llms.txt — положить рядом с сайтом короткий человекочитаемый указатель: вот кто мы, вот ключевые факты, вот ссылки на важные разделы с однострочным описанием каждой.

Ближайшая аналогия — sitemap.xml, но для языковой модели и с отобранной выжимкой вместо полного списка адресов.

Как он устроен

Файл лежит по адресу /llms.txt и пишется в Markdown. Спецификация просит соблюдать порядок: заголовок первого уровня с названием, цитата с кратким описанием, дальше разделы со ссылками.

Скелет файла
# Название компании — чем занимается

> Одно-два предложения: кто вы, что делаете, для кого.

Ключевые факты:
- Профиль: услуги списком.
- География: где работаете.
- Цены: от какой суммы и за что.

## Услуги

- [Название услуги](https://site.ru/uslugi/): чем полезна, сроки, цена.
- [Другая услуга](https://site.ru/drugoe/): то же самое одной строкой.

## Контакты

- [Контакты](https://site.ru/contacts/): телефон, почта, мессенджеры.

Иногда рядом кладут llms-full.txt — расширенную версию с текстами страниц целиком. Смысл в ней есть у документации и баз знаний; у сайта услуг на десять страниц — почти нет.

Кто его на самом деле читает

Честный ответ: неизвестно. Ни Яндекс, ни Google, ни OpenAI не заявляли официально, что используют llms.txt при генерации ответов. При этом файл выкладывают у себя компании, чья документация регулярно попадает в ответы моделей: Anthropic, Cloudflare, Stripe.

Поэтому относиться к нему стоит как к дешёвой страховке: на ранжирование он не влияет. Полчаса работы, ноль риска, потенциальная польза, если поддержка появится.

Чем отличается от robots.txt и sitemap.xml

ФайлДля когоЧто делаетОбязателен
robots.txtпоисковые роботыразрешает и запрещает обходфактически да
sitemap.xmlпоисковые роботыперечисляет все адреса сайтада, для индексации
llms.txtязыковые моделидаёт выжимку и расставляет приоритетынет, инициатива отрасли

Важно: llms.txt ничего не запрещает. Если нужно закрыть сайт от краулеров моделей, это делается директивами для GPTBot, ClaudeBot, PerplexityBot и подобных в robots.txt.

Как составить, чтобы был толк

  1. Начать сразу с фактов в выжимку идут цены, сроки, география, список услуг. «Клиентоориентированный подход» цитировать нечем.
  2. Одна строка — одна ссылка и одно описание без вложенных списков и абзацев на пять строк.
  3. Сверить цифры с сайтом если в llms.txt цена одна, а на странице другая, вы своими руками создали противоречие в источниках.
  4. Не дублировать sitemap в файл идут только ключевые разделы.
  5. Обновлять вместе с ценами устаревший файл вреднее отсутствующего: он раздаёт неверные факты.

Сам по себе файл не выведет сайт в ответы. Он часть работы, которую мы разбираем в статье GEO-оптимизация: факты, разметка, структура текста и упоминания на чужих площадках.

Частые вопросы

Даст ли llms.txt рост в обычной выдаче?

Нет. Это не фактор ранжирования, и Яндекс о поддержке файла не сообщал. На обычную выдачу он не влияет никак.

Где должен лежать файл?

В корне домена: site.ru/llms.txt. Файл отдаётся как обычный текст, кодировка UTF-8. Никакой регистрации в кабинетах для него не нужно.

Чем llms.txt отличается от llms-full.txt?

llms.txt — короткий указатель со ссылками, llms-full.txt — расширенная версия с текстом страниц. Второй файл имеет смысл для документации и баз знаний, где модели полезно прочитать содержимое целиком.

Стоит ли делать, если поддержки нет?

Стоит, если это полчаса работы и файл собран по реальным фактам сайта. Не стоит, если ради него откладывается что-то важное: техническая чистка, скорость, нормальные тексты на коммерческих страницах.

Что читать дальше

GEO-оптимизация GEO-оптимизация (Generative Engine Optimization) — работа над тем, чтобы нейросети называли ваш сайт и бренд в ответах… Открыть AI-поиск AI-поиск — режим, в котором поисковик отвечает сам: нейросеть собирает готовый ответ по нескольким источникам и показывает его… Открыть RAG RAG (Retrieval Augmented Generation, генерация с поиском) — схема работы нейросети, при которой она сначала находит подходящие… Открыть Индексация сайта Индексация — включение страницы в базу поисковой системы, после которого она может показываться в выдаче. Процесс из трёх шагов… Открыть Галлюцинации нейросетей Галлюцинация нейросети — выдуманный факт, который модель выдаёт тем же уверенным тоном, что и правду: несуществующая цена, чужой… Открыть robots.txt robots.txt — текстовый файл в корне сайта, который говорит поисковым роботам, какие разделы обходить, а какие нет. Это… Открыть
Дальше практика

Соберём llms.txt по вашим фактам

Файл бесполезен, если в нём общие слова. Вытащим с сайта цены, сроки и услуги и сведём их в одну выжимку.