llms.txt: что это, нужен ли он вам и как его сделать
Что такое llms.txt простыми словами
llms.txt — текстовый файл в корне сайта, который описывает языковым моделям, что за проект перед ними и где искать главное. По смыслу это аналог robots.txt, только адресован не поисковым роботам, а нейросетям вроде ChatGPT, Claude и Perplexity.
Формат простой: markdown, заголовок первого уровня с названием проекта, короткое описание после символа «>», дальше разделы со ссылками и пояснениями. Никакого кода, никаких скриптов — обычный текст, который человек тоже может прочитать.
Лежит он по адресу вида site.com/llms.txt. Проверить чужой файл можно, просто открыв этот адрес в браузере.
Для чего нужен llms.txt
Идея в том, что языковая модель работает с ограниченным контекстом. Когда она заходит на сайт, ей приходится разбирать HTML со скриптами, меню и баннерами, чтобы вытащить суть. llms.txt даёт эту суть сразу: вот компания, вот услуги, вот цены, вот ключевые страницы.
Практические задачи, которые файл решает: зафиксировать формулировки о компании (чтобы модель пересказывала ваши слова, а не свою интерпретацию), собрать в одном месте ссылки на важные разделы, указать контакты и цены в машиночитаемом виде.
Отдельная польза, о которой редко пишут: файл заставляет владельца бизнеса сформулировать, чем он занимается, в 20 строках без воды. Это упражнение часто вскрывает, что позиционирование расплывчатое.
llms.txt нужен или нет: честный ответ
Коротко: поставить стоит, но рассчитывать на него как на рычаг — нет.
Стандарт предложен в 2024 году Джереми Ховардом (Answer.AI). Это именно предложение, а не утверждённая спецификация. Ни один из крупных разработчиков ИИ официально не заявлял, что его модели обязательно читают llms.txt и учитывают его при формировании ответа.
То есть на сегодня это соглашение, которое поддерживает часть инструментов и не поддерживает другая часть. Обещать клиенту «поставим llms.txt и попадёте в ChatGPT» — значит продавать надежду.
Мы ставим его по трём причинам. Первая: работа занимает около получаса, а потенциальная польза есть. Вторая: вреда нет — файл не влияет на индексацию, скорость и ранжирование. Третья: если стандарт закрепится, сайт уже готов, а если нет — вы потеряли полчаса.
Чего файл точно не делает: не заменяет sitemap.xml, не влияет на позиции в Google, не гарантирует упоминания в ответах нейросетей и не защищает контент от использования моделями.
Как создать llms.txt
Файл пишется вручную в любом текстовом редакторе и кладётся в корень сайта. Никаких генераторов для этого не нужно, хотя они существуют — их выдача обычно требует правки, потому что робот не знает, что в вашем бизнесе главное.
Структура состоит из четырёх обязательных частей: заголовок с названием проекта, краткое описание, тематические разделы со ссылками, необязательный раздел с дополнительными материалами.
Главное правило: писать фактами. Не «мы лидеры рынка», а «работаем с 2025 года, пакеты от 179 000 ₸, Алматы». Модель пересказывает конкретику, а рекламные обороты выбрасывает.
Минимальный пример llms.txt
Рабочий каркас выглядит так: строка «# Название компании», под ней строка с «>» и одним предложением о том, чем компания занимается. Дальше «## Контакты» со списком телефона, сайта и географии. Затем «## Услуги» — список из названия услуги, короткого пояснения и ссылки. В конце «## Частые вопросы» с парами вопрос-ответ в одну-две строки.
Объём для малого бизнеса — от 30 до 100 строк. Всё, что длиннее, имеет смысл выносить в отдельный файл llms-full.txt и ссылаться на него.
Посмотреть живой пример можно на нашем сайте: botclinicco.com/llms.txt. Мы держим его в актуальном состоянии и правим при каждом изменении цен или услуг.
llms.txt и llms-full.txt: в чём разница
llms.txt — короткая навигационная карта: что за проект, где что лежит. llms-full.txt — расширенная версия с полными текстами, детальными описаниями услуг, развёрнутым FAQ.
Разделение нужно, чтобы модель с маленьким контекстным окном получила главное, а модель с большим — подробности. Если сайт небольшой, второй файл можно не делать.
Частая ошибка: продублировать в llms-full.txt весь сайт целиком. Смысл не в объёме, а в том, чтобы дать структурированные факты, которых нет в разметке.
Как сделать llms.txt на Tilda и других конструкторах
На конструкторах доступ к корню сайта ограничен, и это главная сложность. В Tilda файл добавляется через настройки сайта: раздел «Ещё» → «Экспорт и загрузка файлов», либо через подключение собственного домена и загрузку файла на хостинг.
Если платформа не позволяет положить файл в корень, рабочего обходного пути нет: адрес /llms.txt жёстко закреплён соглашением. Размещение по другому адресу лишено смысла — его никто не найдёт.
На WordPress файл кладётся в корневую папку через FTP или файловый менеджер хостинга. На Next.js, как у нас, — в папку public, откуда он попадает в корень при сборке.
Как проверить llms.txt
Базовая проверка занимает секунды: откройте site.com/llms.txt в браузере. Файл должен отдаваться как обычный текст с кодом ответа 200, а не скачиваться и не показывать страницу 404.
Вторая проверка — на кодировку. Файл должен быть в UTF-8, иначе кириллица превратится в мусор. Это частая проблема при выгрузке из Windows-редакторов.
Третья, самая полезная: скопируйте содержимое файла и спросите у любой нейросети, чем занимается описанная компания. Если ответ совпадает с тем, что вы хотели донести — файл работает. Если модель отвечает расплывчато, значит в тексте слишком много общих слов.
Онлайн-валидаторы существуют, но проверяют они в основном формат markdown, а не осмысленность содержимого. Проверка через саму нейросеть информативнее.
Частые ошибки
Копирование текста с главной страницы. Рекламный текст сайта написан для человека и содержит обороты вроде «мы поможем вашему бизнесу выйти на новый уровень». Модель из такого не извлечёт ничего конкретного.
Устаревшие данные. Файл легко забыть при обновлении цен — он лежит в стороне от кода и не попадается на глаза. Мы сами наступили на это: сменили цены на сайте, а в llms.txt два месяца оставался старый прайс со словом «промо». Нейросеть читала бы именно его.
Ссылки на несуществующие страницы. Битая ссылка в файле, который создан для повышения доверия, работает ровно наоборот.
Попытка запихнуть ключевые слова. llms.txt — не место для SEO-текста: перечисление запросов через запятую модель распознаёт как спам и игнорирует блок целиком.
llms.txt и robots.txt: не путать
robots.txt управляет доступом: разрешает или запрещает роботам обходить разделы сайта. llms.txt ничем не управляет — он только описывает и подсказывает.
Если задача — запретить нейросетям использовать контент, нужен именно robots.txt с директивами для конкретных краулеров: GPTBot у OpenAI, ClaudeBot у Anthropic, PerplexityBot, Google-Extended для обучения моделей Google.
Обратная задача — открыть доступ — решается там же: убедитесь, что эти краулеры не заблокированы. Бывает, что сайт годами закрыт от них по инерции, а владелец при этом заказывает продвижение в нейросетях.
Частые вопросы
llms.txt что это простыми словами?+
Текстовый файл в корне сайта, который объясняет нейросетям, чем занимается компания и где искать главное. По смыслу — аналог robots.txt, но для языковых моделей, а не поисковых роботов. Читается человеком, пишется в формате markdown.
llms.txt нужен или нет?+
Поставить стоит, но рассчитывать на него как на инструмент продвижения не нужно. Стандарт предложен в 2024 году и официально не поддержан ни одним крупным разработчиком ИИ. Мы ставим его клиентам, потому что работа занимает полчаса и вреда нет, но результата он сам по себе не даёт.
Влияет ли llms.txt на позиции в Google?+
Нет. Google не использует этот файл в ранжировании и официально о нём не высказывался. На индексацию, скорость загрузки и позиции он не влияет никак.
Как создать llms.txt?+
Написать вручную в текстовом редакторе и положить в корень сайта. Структура: заголовок с названием, строка описания после «>», разделы «## Контакты», «## Услуги», «## Частые вопросы» со списками. Кодировка UTF-8. Для малого бизнеса хватает 30–100 строк.
Нужен ли генератор llms.txt?+
Нет, файл проще написать руками. Генераторы существуют, но выдают шаблонную выжимку из HTML и не знают, что в вашем бизнесе главное. Их результат всё равно приходится переписывать, а времени уходит столько же.
Как проверить llms.txt?+
Откройте site.com/llms.txt в браузере: должен отдаваться текст с кодом 200 в кодировке UTF-8. Полезнее формальной проверки другое — скопируйте содержимое и спросите у нейросети, чем занимается эта компания. Совпал ответ с задуманным — файл работает.
Чем llms.txt отличается от llms-full.txt?+
Первый — короткая карта сайта для модели, второй — расширенная версия с полными текстами и подробным FAQ. Разделение нужно для моделей с разным размером контекстного окна. Небольшому сайту второй файл не обязателен.
Можно ли сделать llms.txt на Tilda?+
Да, через настройки сайта в разделе загрузки файлов либо через хостинг при подключённом домене. Главное требование — файл должен открываться именно по адресу /llms.txt: размещение по другому пути бессмысленно, соглашение закрепляет конкретный адрес.
Читают ли нейросети llms.txt на самом деле?+
Часть инструментов читает, часть игнорирует. Публичных подтверждений от OpenAI, Google или Anthropic, что их модели обязательно учитывают этот файл при ответе, нет. Поэтому честная формулировка: файл может помочь, но гарантий не даёт.
Защищает ли llms.txt контент от использования нейросетями?+
Нет, это распространённое заблуждение. Файл ничего не запрещает — он только описывает. Ограничить доступ моделей к контенту можно через robots.txt, прописав правила для GPTBot, ClaudeBot, PerplexityBot и Google-Extended.
Что писать в llms.txt, чтобы попасть в ответы нейросетей?+
Факты вместо рекламы: год основания, город, конкретные услуги, диапазон цен, ответы на частые вопросы клиентов. Модель пересказывает проверяемую конкретику и выбрасывает обороты вроде «лидер рынка» и «индивидуальный подход».
Как часто обновлять llms.txt?+
При каждом изменении фактов: цен, услуг, контактов. Файл лежит в стороне от кода, поэтому про него легко забыть — мы сами два месяца отдавали в нём отменённый прайс. Стоит внести его в чек-лист любых правок, касающихся информации о компании.