Простой markdown-файл в корне сайта, который объясняет нейросети, чем вы занимаетесь. Расскажу, как это устроено на практике — на примере своего сайта.
llms.txt: что это и зачем сайту в 2026 году
Разбираю, что такое llms.txt, чем он отличается от robots.txt и sitemap.xml и как я сделал такой файл у себя на сайте — без иллюзий про автоматическую генерацию.
Трафик из нейросетей в рунете вырос почти в девять раз за год — такую цифру я недавно встретил у Коммерсанта, разбирая переходы с ChatGPT, Perplexity и других ИИ-сервисов на сайты компаний. Вопрос только один: попадёт ли в эти переходы именно ваш сайт? llms.txt — это простой markdown-файл в корне сайта, который на понятном языке объясняет языковой модели, чем вы занимаетесь, какие у вас услуги и что почитать. Ставится за час. А вот моё отношение к нему за последние месяцы менялось несколько раз.
Что такое llms.txt и чем он отличается от robots.txt и sitemap.xml
Три файла, три разные аудитории — и путать их легко.
robots.txt — правила доступа: кому можно ходить по сайту, а кому нельзя. sitemap.xml — список страниц для индексации, для классических роботов Яндекса и Google. А llms.txt — не про доступ и не про список URL, а про смысл: коротко и по-человечески, что за компания и куда смотреть за подробностями.
| Файл | Для кого | Что описывает |
|---|---|---|
| robots.txt | Поисковые и ИИ-краулеры | Что можно, а что нельзя сканировать |
| sitemap.xml | Классические поисковые роботы | Список страниц для индексации |
| llms.txt | Языковые модели (ChatGPT, Claude, Perplexity) | Кто вы, чем занимаетесь, ключевые услуги и статьи |
Важная оговорка: официальным стандартом W3C или IETF llms.txt не является — это неформальная спецификация от сообщества. Но её уже завели у себя Vercel, GitHub, Stripe.
Как я сделал свой llms.txt
Расскажу честно, тут есть нюанс. В заметках к этой статье было написано, что у меня llms.txt генерируется автоматически через отдельную Artisan-команду при каждом деплое. Звучит красиво. Полез в код проверять... и такой команды не нашёл. Файл лежит в public/llms.txt обычным текстом и правится руками — точно так же, как robots.txt: открыл, поправил, закоммитил.
Не оправдываюсь, а объясняю: ручное обновление надёжнее скрипта, который сам решает, что писать про мой бизнес. Зато есть жёсткая дисциплина: правка цены или условий уходит одним коммитом сразу в страницу услуги, каталог ИИ-консультанта сайта, мини-приложение, YML-фид и llms.txt. Когда цена Турникета в этом году упала с 30 000 до 10 000 ₽, её пришлось поправить руками в пяти местах разом. Автоматизация так себе, зато рассинхрона по цене нет.
Внутри — описание студии, услуги с ценами (в том числе Разработка сайта под ключ от 50 000 ₽ , куда разметку schema.org я закладываю с первого дня) и ключевые статьи блога. Модель читает markdown буквально, приукрашивать бессмысленно.
Как открыть сайт для ИИ-краулеров
Как ни странно, тут почти нечего настраивать — в хорошем смысле.
Синтаксис robots.txt прежний: User-agent — к кому относится правило, Disallow — что запрещено, Allow — явное разрешение, Sitemap — где карта сайта. У меня в файле нет ни одной строки Disallow — только Clean-param для Яндекса (чтобы UTM-метки не плодили дубли страниц) и ссылка на sitemap.xml. Хотите цитирований в ChatGPT и Perplexity — не добавляйте Disallow на GPTBot, ClaudeBot, PerplexityBot и Google-Extended.
А ведь примерно четверть крупных сайтов их блокирует: GPTBot по майским данным формирует около 11% всех запросов ИИ-ботов, ClaudeBot — почти 10%. Мы все сейчас нащупываем правила игры вслепую: кто-то режет всё подряд из страха утечки контента, кто-то открывает нараспашку ради упоминаний. Я — за второй вариант.
Тема шире одного файла — это часть GEO, оптимизации под генеративные нейросети вместо классической выдачи. Если ещё разбираетесь, какие модели вообще стоит использовать в бизнесе — большой разбор здесь: лучшие ИИ для бизнеса в 2026. А если тема ИИ в компании только начинается — с чего начать и как не слить бюджет.
Готов ли ваш сайт к ИИ-краулерам
- В robots.txt нет Disallow на GPTBot, ClaudeBot, PerplexityBot и Google-Extended
- На сайте есть актуальный sitemap.xml
- Есть llms.txt с описанием компании, услуг и ключевых статей
- Цены и условия услуг совпадают на всех страницах и во всех файлах для ИИ
- Настроена базовая микроразметка schema.org
- Тексты услуг читаются как обычный HTML, а не спрятаны в PDF или на картинках
Двадцать минут на файл против рассинхрона цен по пяти местам — тут выбор, честно говоря, простой.
Нужен сайт, понятный и людям, и ИИ?
Соберу лендинг с SEO-базой под капотом — schema.org, аналитика, открытый для краулеров robots.txt. Бесплатно оценю ваш текущий сайт за 15 минут.