Что такое llms.txt простыми словами?
Это текстовый файл в корне сайта, который коротко объясняет нейросети и AI-агенту: кто вы и какие страницы читать первыми.
Файл в корне, карта URL и проверка без мифов — чтобы нейросети видели ваши сильные страницы
Канал Maya Pro в TelegramФайл llms.txt — это короткая Markdown-карта вашего сайта для нейросетей и AI-агентов. Его кладут в корень домена по адресу https://ваш-сайт.ru/llms.txt, рядом с привычными robots.txt и sitemap.xml. Формат предложил Jeremy Howard (Answer.AI / fast.ai) в сентябре 2024; канон описан на llmstxt.org.
Зачем он нужен владельцу сайта из России? Чтобы агент, IDE или человек через чат с ИИ быстрее нашли ваши сильные материалы: курсы, гайды, FAQ, кейсы. Файл не заменяет контент и не поднимает позиции в Яндексе или Google сам по себе. Он помогает машине не блуждать по тысячам URL и не путать черновики с каноном.
Файл llms.txt — это короткая Markdown-карта вашего сайта для нейросетей и AI-агентов. Его кладут в корень домена по адресу https://ваш-сайт.ru/llms.txt, рядом с привычными robots.txt и sitemap.xml. Формат предложил Jeremy Howard (Answer.AI / fast.ai) в сентябре 2024; канон описан на llmstxt.org.
Маркер: простыми словами. llms.txt — это не «волшебный SEO-файл», а понятный список: кто вы, о чём сайт и какие страницы читать первыми. Как меню для модели, а не как гарантия места в выдаче.
Зачем он нужен владельцу сайта из России? Чтобы агент, IDE или человек через чат с ИИ быстрее нашли ваши сильные материалы: курсы, гайды, FAQ, кейсы. Файл не заменяет контент и не поднимает позиции в Яндексе или Google сам по себе. Он помогает машине не блуждать по тысячам URL и не путать черновики с каноном.
Его часто путают с тремя вещами:
Ещё один миф: «ChatGPT, Claude и Perplexity уже фоном качают llms.txt со всех сайтов». По замерам трафика AI-ботов фоновые визиты к /llms.txt ничтожны (порядка долей процента). Реальная польза сегодня чаще в другом слое: когда агент или IDE читает файл по запросу, а не когда «бот проиндексировал ночью».
Маркер: простыми словами. GEO (Generative Engine Optimization) — это работа над тем, чтобы ваш сайт и бренд чаще попадали в ответы нейросетей. Llms.txt — один маленький рычаг внутри GEO, а не вся стратегия.
Файл имеет смысл, если у вас есть что показывать как канон:
/llms.txt и /llms-full.txt с документации.Если сайт — одна визитка на три абзаца без полезных страниц, файл можно сделать «для порядка», но чуда не будет: цитировать почти нечего.
Коротко: llms.txt = навигация для ИИ. Контент = то, что цитируют. Без живых страниц карта пустая.
Оба файла живут в корне, оба «для машин» — и на этом сходство заканчивается. Путать их — частая ошибка новичков.
robots.txt — правила доступа. Строки вроде User-agent и Disallow говорят боту: ходи сюда или не ходи. Для AI-видимости важно не закрыть нужных ботов, если вы хотите, чтобы они могли читать сайт: GPTBot, ClaudeBot, Google-Extended, PerplexityBot, Anthropic-AI (список сверяйте с актуальной политикой сервисов).
Если в robots запретить GPTBot, а в llms.txt красиво расписать «читайте наш блог» — вы сами противоречите себе.
Llms.txt не «разрешает» и не «запрещает» обход. Он даёт:
- название: пояснение;Optional — то, что можно пропустить, если контекста мало.Маркер: простыми словами. Optional — это полка «по желанию». Агент при нехватке места может эти URL не читать. В основную карту кладите только то, без чего сайт понять нельзя.
Ожидаемый сценарий по спецификации — чтение «по запросу» (inference / on-demand), а не обучение модели с нуля на вашем файле.
Схема провала выглядит так:
Disallow.Итог: карта есть, доступ к страницам нет. Сначала откройте важные разделы ботам (если политика компании это позволяет), потом указывайте их в llms.txt.
Карта AI-видимости
Не sitemap целиком и не «магия файла» — цепочка: отобрать страницы → собрать llms.txt → открыть путь ботам → проверить 200 → дать моделям понятный указатель.
Дальше разберём каркас файла: поля, тон ссылок и что класть в Optional.
Спецификация простая. Порядок секций:
> — краткий summary (на практике почти обязателен для нормального файла);Optional.Ориентиры по размеру индекса: держите файл компактным — примерно 2–5 KB, часто 10–20 ключевых ссылок, ориентир валидаторов меньше 20 KB. Content-Type: text/plain; charset=utf-8 или text/markdown. Ответ сервера — HTTP 200, без авторизации и без лишних редиректов. Ссылки — абсолютные https://.... Без HTML-тегов и вложенных списков.
Минимальный рабочий каркас выглядит так:
# Название проекта
> Одна-две фразы: чем занимаетесь и для кого сайт.
Короткий абзац без новых заголовков: что важно знать агенту.
## Основные страницы
- Главная (https://example.ru/) — чем занимается компания
- Услуги (https://example.ru/uslugi/) — список направлений
- Блог: гайд по теме (https://example.ru/blog/gayd/) — практический материал с шагами и FAQ
## Optional
- Архив новостей (https://example.ru/news/) — лента обновлений, не канон
Тон — деловой и короткий. Без «лучший в Москве», без набивки ключей, без рекламных лозунгов. Пишите так, будто объясняете коллеге за 30 секунд.
Включайте:
Выкидывайте из основной карты:
Правило контент-завода: в карту попадают только страницы, которые вы готовы цитировать как канон. Обновление llms.txt — шаг после публикации нового сильного лонгрида, а не «раз в год для галочки».
Разберём логику на живом RU-кейсе. У проекта etern8 файл доступен по адресу корня сайта; практический разбор на русском есть в статье на Хабре. Типичная сильная схема:
llms-full.txt с развёрнутым текстом.Слабый антипаттерн рядом: скопировали sitemap, вставили 200 URL без описаний, забыли blockquote, дали относительные ссылки /blog/ вместо https://.... Такой файл формально «есть», но агенту от него мало толка.
Сильные docs-примеры в мире продуктов часто делают Anthropic, Vercel, Cloudflare, Stripe, GitHub — там файл заточен под агентов документации, а не под «SEO-магию».
Ниже — сценарий, который новичок из России может повторить за 30–60 минут на WordPress (Beget) или на статике.
Признак успеха шага 1: у вас таблица из 10–20 строк: URL + пояснение + «основной / Optional». Нет битых ссылок.
llms.txt в редакторе (Блокнот, VS Code, Cursor).# Название → > summary → абзац → ## Секция → списки ссылок. - Статика / Next / Vite: положите в public/llms.txt, задеплойте. - WordPress на Beget: через файловый менеджер или SFTP загрузите в корень рядом с wp-config.php и robots.txt (не в папку темы и не в медиабиблиотеку «для красоты», если оттуда не отдаётся корень). - Плагины автогенерации (Citable GEO Schema и аналоги): можно стартовать с генерации, но обязательно вычитайте текст руками — автогенераторы часто льют воду.
Опционально сделайте копию /.well-known/llms.txt — это помогает discovery, но не заменяет корневой /llms.txt.
Маркер: простыми словами. well-known — служебная папка /.well-known/ на сайте, куда кладут стандартные файлы «для машин». Дубль llms.txt туда — страховка находки, а не новый формат.
https://ваш-домен.ru/llms.txt в режиме инкогнито./llms.txt, без редиректа на главную, /ru/ или «красивый» PHP-роут.Признак успеха шага 3: видите Markdown-текст, статус 200, URL стабильный.
/robots.txt. Убедитесь, что важные разделы и AI-боты не закрыты без причины.Маркер: простыми словами. JSON-LD — машиночитаемая «визитка» на странице (тип организации, FAQ и т.д.). Speakable — подсказка, какие куски текста удобно читать вслух / коротко цитировать. Llms.txt, JSON-LD и Speakable должны говорить об одном и том же сайте, а не спорить друг с другом.
Типичные ошибки новичка на этом этапе:
| Ошибка | Что сделать |
|---|---|
| Файл лежит в теме, а корень отдаёт 404 | Перенести в document root / настроить отдачу |
Редирект /llms.txt → главная | Убрать правило в .htaccess / nginx / CMS |
| Относительные ссылки | Заменить на абсолютные https:// |
| GPTBot в Disallow, а файл зовёт «читайте нас» | Согласовать robots и политику доступа |
Короткий llms.txt — оглавление. llms-full.txt — уже «книга»: склеенный полный текст канонических материалов, чтобы агент мог читать без обхода десятков страниц.
Маркер: простыми словами. llms-full.txt — большой файл с полным текстом важных материалов. Нужен, когда агенту мало оглавления и хочется сразу дать тело гайдов. Не обязателен каждому сайту.
| llms.txt | llms-full.txt | |
|---|---|---|
| Роль | карта и приоритет | полный текст канона |
| Размер | компактно, часто 2–5 KB, <20 KB | ориентир 20–50 KB, потолок практики ~500 KB |
| Когда достаточно | лендинг, услуга, 10–15 сильных URL | docs, база знаний, длинные гайды |
| Риск | слишком общий | слишком тяжёлый / устаревший |
В кратком файле можно дать ссылку на full-версию отдельной строкой в основной секции.
Не склеивайте всё подряд: теги, архивы, старые новости, дубли. Берите только канон. Обновляйте full вместе с лонгридами: устаревший 12‑тысячесловный файл хуже короткой свежей карты. Если нет ресурса поддерживать full — лучше качественный короткий llms.txt, чем мёртвый «кирпич».
Генератор полезен, если:
Поисковый спрос на «генератор llms.txt» есть — и это нормальный старт. Только не публикуйте сырой вывод «как есть».
Шаблон врёт, когда:
Ручная сборка из 15 ссылок часто точнее автомата на 200 строк. Для контент-завода правило простое: генератор = черновик, редактор = финал.
Пройдите список:
https://домен/llms.txt открывается → 200./.well-known/llms.txt содержимое согласовано с корнем.Онлайн-валидаторы и экосистема утилит (llms_txt2ctx, каталоги llmstxt) помогают поймать грубые ошибки формата — но финальная проверка глазами обязательна.
На конструкторах (Тильда и аналоги) часто нет прямого доступа к корню. Тогда файл загружают отдельно и настраивают отдачу/редирект на /llms.txt. Опасность: редирект на HTML-страницу или PHP-шаблон — агент получает «красивую страницу», а не текст файла.
На WordPress ломатели типичны другие: плагин «красивых URL», кэш, правило «всё на index.php», файл положили в папку медиабиблиотеки WordPress (uploads), а не в корень и ждут, что он станет корневым. Решение: отдавать именно из корня домена или через явное правило веб-сервера.
Честный срез на 2026 год:
Подробный разбор мифов и тестов «кто читает файл» — в разборе на Хабре. Рабочая позиция для владельца сайта: файл — дешёвый и полезный указатель, а не кнопка «попасть в ChatGPT за неделю».
Продвижение в нейросетях и geo-оптимизация — шире, чем один файл. Llms.txt помогает агенту найти канон. Цитату берёт из страницы: чёткие тезисы, факты, списки, FAQ, таблицы. Если в карте указан пустой лендинг без пользы — указывать было нечего.
Связка для команды контента:
Короткий список рядом с файлом:
Итог блока: llms.txt ускоряет находку канона. GEO без контента не работает. Контент без карты хуже находится агентами.
Самые дорогие по времени ошибки:
/llms.txt → 200, без редиректа на HTML.Это текстовый файл в корне сайта, который коротко объясняет нейросети и AI-агенту: кто вы и какие страницы читать первыми.
Да, это разные задачи. Robots — доступ. Sitemap — карта для поиска. Llms.txt — смысловая карта для ИИ и агентов. Один не заменяет другой.
Краткий файл — оглавление. Full — развёрнутый текст канонических материалов. Начинайте с краткого; full добавляйте, если есть docs/база знаний и ресурс поддерживать объём.
Откройте https://ваш-домен.ru/llms.txt в браузере. Должен быть статус 200 и сырой Markdown. Дополнительно можно прогнать валидатор формата и сверить robots.
Как черновик — да. Как финал без правки — часто нет: шаблоны тащат лишние URL и пустые описания. Лучший результат: генератор + ручная чистка до 10–20 ссылок.
Нет. Файл повышает шанс, что агент быстро найдёт ваш канон, но не гарантирует цитату. Решают содержание страниц, доступность, согласованность фактов и то, как конкретная система ищет источники.