GEO · WordPress · llmstxt.org

Как создать llms.txt для WordPress:пошаговый гайд по видимости в нейросетях

Спецификация, ручная заливка или плагин, llms-full.txt, проверка HTTP 200 и связка с GEO — без обещаний «ранжирования в ChatGPT»

Вы открыли сайт в браузере — и видите меню, статьи, кнопки. Нейросеть и ИИ-агент видят сайт иначе: они часто хватают куски страниц наугад. Файл llms.txt — это короткая «карта» в корне домена: какие страницы важны и о чём они. Ниже — как собрать такой файл на WordPress за один вечер, проверить HTTP 200 и не сломать SEO.

Коротко. llms.txt не заменяет сильный контент и не обещает место в ответах ChatGPT. Это low-cost порядок: curated-список URL для агентов и инструментов, которые файл умеют читать. Google Search этот файл игнорирует.

/llms.txt HTTP 200 10–20 URL GEO-гигиена
llms.txt · корень WP
# Ковчег
> карта для ИИ-агентов
## Основные страницы
- [Главная](https://…)
- [Курс](https://…)
→ проверка: curl -I /llms.txt

Зачем сайту файл llms.txt и чего он не обещает

llms.txt — предложение сообщества (сайт спецификации llmstxt.org): положить в корень домена Markdown-файл с названием проекта, кратким описанием и списком ключевых ссылок. Авторы спеки ориентируют файл прежде всего на сценарии «здесь и сейчас» — агент, IDE, чат с поиском, — а не на обязательное обучение моделей.

Маркер: простыми словами. llms.txt — это текстовая «оглавление» сайта для нейросетей: не весь каталог страниц, а короткий список того, что вы сами считаете главным.

Чего файл не делает:

  • не является фактором ранжирования в Google и Яндексе;
  • не гарантирует, что ChatGPT, Claude или Perplexity начнут цитировать ваш блог;
  • не заменяет robots.txt, карту сайта и нормальный HTML с понятными заголовками.

Позиция Google Search Central прямая: специальные AI-файлы и Markdown не нужны, чтобы попасть в поиск и в generative AI features Google; Search игнорирует llms.txt — наличие не помогает и не вредит. Держать файл можно «для других систем». Исследование Ahrefs по большой выборке доменов показало жёсткую реальность: у большинства валидных файлов за месяц было ноль запросов, а доля AI retrieval-ботов среди редких запросов крошечная. Вывод для практики: файл — дешёвая гигиена и карта для агентов, а не «кнопка цитат».

В русскоязычных гайдах иногда встречаются обещания вроде «+30–60% цитируемости за пару недель». Открытой методологии под такие цифры нет, они расходятся с данными Ahrefs и с позицией Google. В этой статье таких обещаний не будет.

Чем llms.txt отличается от robots.txt и sitemap.xml

Три файла в корне решают разные задачи. Их нельзя подменять друг другом.

ФайлЗадачаФорматКто читаетСтатус
robots.txtразрешить или запретить обходдирективылюбые краулерыширокий стандарт
sitemap.xmlперечислить URL для поискаXMLпоисковикистандарт discovery
llms.txtcurated-карта + смыслMarkdownLLM и агенты (добровольно)предложение llmstxt.org
llms-full.txtрасширенный дамп / полный текстMarkdowningest, RAG, docsопциональный компаньон

Маркер: простыми словами. Voluntary adoption значит: никто не обязан читать ваш llms.txt. Кто умеет — может открыть. Кто не умеет — просто пройдёт мимо. Это не «закон интернета», а договорённость.

Sitemap отвечает: «вот все URL, которые можно индексировать». llms.txt отвечает: «вот 10–20 страниц, с которых стоит начинать, если нужно понять сайт». robots.txt отвечает: «сюда ходить можно, сюда нельзя». Для GEO-видимости важны все три слоя плюс сам контент.

Маркер: простыми словами. GEO (Generative Engine Optimization) — это работа над тем, чтобы ваш материал чаще и точнее попадал в ответы нейросетей. AEO — близкий термин про ответы AI. Это не отдельный «магический файл», а качество страниц, структура, факты и понятные формулировки. Файл llms.txt лишь помогает агенту быстрее найти сильные URL.

Какие страницы стоит отдать нейросетям в первую очередь

Не тащите в файл весь блог. Спецификация как раз про кураторский обзор, а не про копию sitemap. Для владельца контент-завода на WordPress разумный старт — 10–20 канонических URL:

  1. Главная и ключевые продуктовые/курсовые страницы с ясным H1.
  2. Страница «Об авторе» / экспертности (E-E-A-T).
  3. 5–10 сильнейших лонгридов: агенты, автопубликация, SEO/GEO, автоматизация.
  4. FAQ или страница с частыми возражениями.
  5. Контакты / оффер в Telegram — если это каноническая точка входа.

К каждой ссылке — одна короткая пометка: что на странице и что можно цитировать. Абсолютные URL (https://ваш-домен.ru/...), без относительных путей вроде /blog/post.

Структура Markdown по спецификации llmstxt.org

Формат простой. Его можно набрать в любом текстовом редакторе и сохранить как llms.txt.

H1, краткое описание и список разделов с URL

По спецификации обязателен только H1 — имя сайта или проекта. Дальше рекомендуется:

  1. Блок с кратким summary (в Markdown это обычно цитата/blockquote).
  2. Свободный текст без новых заголовков до первых H2 (если нужен).
  3. Секции ## ... со списками ссылок вида: дефис, название в квадратных скобках, абсолютный URL в круглых, затем двоеточие и пояснение.
  4. Секция ## Optional — низкий приоритет: клиенты с коротким контекстом могут её пропустить.

Пример каркаса:

# Название сайта или проекта

> Одной-двумя фразами: чем занимаетесь и для кого сайт.

## Основные страницы

- [Главная](https://example.ru/): о чём проект и кому полезен
- [Курс «Контент-завод»](https://example.ru/kurs/): программа и формат обучения
- [Об авторе](https://example.ru/ob-avtore/): экспертиза и кейсы

## Сильные материалы

- [Гайд по llms.txt](https://example.ru/llms-txt-wordpress-geo-gayd-2026/): как собрать файл на WordPress
- [Автопубликация в блог](https://example.ru/avtopublikaciya/): пайплайн лонгридов

## Optional

- [Архив блога](https://example.ru/blog/): полный список статей

Пример рабочего файла: что копировать, что править под себя

Копируйте структуру, не чужие URL. Под себя правьте:

  • H1 — реальное имя бренда;
  • summary — без маркетингового тумана («лучшие в мире»), лучше факт: ниша + аудитория;
  • списки — только живые канонические страницы с кодом 200;
  • Optional — второстепенное, что жалко выкинуть, но не критично для первого знакомства.

Если пишете по-русски — сохраняйте файл в UTF-8 без лишнего BOM. Кириллица в llms.txt нормальна; ломается она из‑за кривой кодировки на сервере, а не из‑за языка.

llms.txt · карта для ИИ

От хаоса URL к кураторскому индексу

Сцена ниже — не hero, а мостик: WordPress отдаёт десятки страниц, куратор выбирает 10–20 канонических URL, файл ложится в корень как /llms.txt, агент читает карту и идёт по сильным материалам.

  • Не sitemap — curated-список, а не «все URL подряд».
  • Корень домена — HTTP 200 и абсолютные ссылки, без редиректа на PHP.
  • GEO-гигиена — файл помогает найти сильные страницы, но не заменяет контент.

Дальше — три пути внедрения на WordPress: руками, плагином или SEO-модулем.

Цикл ~42 с · хаос → курация → /llms.txt → агент

Три пути внедрения на WordPress

На практике у владельца WordPress есть три рабочих маршрута. Выбор зависит от того, какие SEO-плагины уже стоят и нужен ли вам контроль списка URL.

Ручная заливка в корень домена

Подходит, если хостинг даёт доступ к файлам (файловый менеджер Beget, SFTP/SSH) и вы хотите короткий curated-список без автогенерации.

1

Создайте файл

Создайте llms.txt на компьютере в UTF-8 по каркасу выше.

2

Залейте в корень

Туда же, где лежат wp-config.php и обычно robots.txt. Адрес: https://ваш-домен.ru/llms.txt, не медиатека и не папка темы.

3

Откройте в инкогнито

Должен открыться текст, не страница темы WordPress.

4

Проверьте заголовки

Желательно text/plain и кодировка UTF-8.

5

Сбросьте кэш

Если стоит WP Super Cache, W3 Total Cache или CDN — сбросьте и откройте файл снова.

Признак успеха: по адресу /llms.txt код HTTP 200, видно ваш H1 первой строкой, нет шапки темы и меню сайта.

Типичные ошибки новичка:

  1. Файл лежит в медиатеке или в папке темы → агент ищет корень и получает 404.
  2. Сервер отдаёт HTML «мягкой» 404-страницы темы → для агента это мусор.
  3. В robots.txt стоит запрет вроде Disallow: /*.txt → добавьте явное разрешение на /llms.txt.

Маркер: простыми словами. MIME (Content-Type) — это «ярлык» ответа сервера: «я отдаю текст» или «я отдаю HTML-страницу». Агенту нужен текст. Если ярлык и содержимое — HTML-шаблон темы, карта бесполезна.

Плагин генерации Website LLMs.txt и SEO-модули

Если не хотите возиться с FTP, на WordPress есть готовые пути:

  • Website LLMs.txt — генерирует /llms.txt и опционально /llms-full.txt, умеет учитывать noindex из Yoast / Rank Math / SEOPress / AIOSEO, расписание обновления, fallback через rewrite, если корень недоступен на запись. В FAQ плагина прямо сказано: видимость в ChatGPT/Claude/Perplexity не гарантируется. Обновляйте плагин: в старых версиях была уязвимость XSS (CVE-2026-6711), патч с 8.2.7.
  • Rank Math — модуль LLMS Txt: тумблер в Dashboard, редактирование файла, типы записей/таксономии, лимит (по умолчанию до 100), исключение noindex. В базе знаний Rank Math честно пишет: это proposal, не официальный стандарт, adoption ограничен.
  • Yoast — генерация llms.txt в один клик, auto/manual выбор ключевого контента, preview; на официальной странице фичи позиционируется как доступная функция AI tools (проверяйте UI своей версии на момент настройки).
  • AIOSEO — вкладка Sitemaps → LLMs.txt: включает короткий и полный файл, title/description, лимиты и exclude.

Важно: не включайте сразу два генератора (например Yoast + Website LLMs.txt). Получите конфликт, кто «владеет» URL /llms.txt.

Плагины удобны из России так же, как обычные SEO-плагины WordPress: ставятся из админки или с ru.wordpress.org. Оплата зарубежных SaaS здесь не нужна — достаточно локального WP на российском хостинге.

Когда достаточно генератора, а когда лучше руками

СитуацияЛучший путь
Уже стоит Rank Math / Yoast / AIOSEO и устраивает их списокВключить встроенный модуль, подчистить лишнее
Нужен и короткий индекс, и llms-full.txt, плюс расписаниеWebsite LLMs.txt или AIOSEO
Хотите ровно 12 curated URL под контент-заводРучной файл или ручная правка после генерации
Корень read-only / «No LLMS.txt in root»Плагин с virtual serve / Generate Now + проверка cron
Нет времени разбираться в админкеГенератор + потом ручная чистка до 10–20 ссылок

Автосписок на десятки и сотни URL выглядит «солидно», но спорит с идеей кураторства. Лучше короткий сильный список, чем sitemap в Markdown-одежде.

Когда нужен llms-full.txt и как не сломать SEO

Короткий индекс vs полный дамп контента

Маркер: простыми словами. llms-full.txt — «толстый» компаньон: расширенный экспорт или почти полный текст важных страниц. Его включают, если нужен корпус для docs/RAG/агента. Для первой версии сайта чаще хватает короткого llms.txt.

Короткий файл — карта. Полный — склад. Не путайте. Если включили llms-full.txt плагином:

  • убедитесь, что URL https://домен.ru/llms-full.txt тоже отдаёт текст с кодом 200;
  • не дублируйте в полном файле черновики, noindex и служебные страницы;
  • помните: больший объём ≠ больше цитат.

robots.txt, кэш, MIME и редирект на PHP — типичные ловушки

Чек-лист «не сломать SEO и доступ»:

  1. robots.txt. Если где-то запрещены *.txt, добавьте Allow: /llms.txt (и при необходимости /llms-full.txt). Сам llms.txt не заменяет robots.
  2. Кэш и CDN. После первой генерации старый 404 или HTML может «залипнуть». Сбросьте кэш.
  3. MIME и UTF-8. Плагины чинили BOM и charset=utf-8 как раз из‑за кириллицы и валидаторов. Если буквы «кракозябры» — проблема кодировки.
  4. Редирект на PHP. Иногда /llms.txt уводит на скрипт или мягкую 404 темы. Для агента важен стабильный текстовый ответ, а не красивая HTML-заглушка.
  5. Путь .well-known. Отдельные эксперименты кладут файлы в /.well-known/, но канон спеки — корень /llms.txt. Не усложняйте без нужды.
  6. Двойные плагины. Один владелец URL /llms.txt.

SEO-фундамент (индексация, скорость, структурированные данные, понятный HTML) важнее AI-файла. Google прямо говорит: для Search важнее качество страниц, а не новый Markdown в корне.

Как проверить, что файл реально открывается

HTTP 200, канонический URL и валидатор

Пошаговая проверка после публикации:

  1. Откройте https://ваш-домен.ru/llms.txt в браузере.
  2. Убедитесь: статус 200, виден текст, первая строка — # ....
  3. Сравните с каноническим доменом (www / без www, http / https) — не должно быть цепочки редиректов на HTML-ошибку.
  4. Прогоните файл через любой онлайн-валидатор (их ищут как «валидатор llms txt»). Смотрите на H1 и абсолютные URL.
  5. Если используете плагин — нажмите Generate Now и убедитесь, что WP-Cron жив (иначе расписание не обновит файл).

Маркер: простыми словами. Валидатор — это проверка «файл похож на правильный llms.txt»: есть H1, ссылки читаются, нет явного мусора. Это не гарантия, что нейросеть вас процитирует.

Отдельно: в проверках Agentic Browsing / Lighthouse отсутствие llms.txt часто даёт N/A, а серверная ошибка на URL файла — уже проблема. Это чек-лист доступности, не ranking-сигнал.

Чек-лист ошибок после публикации

  • Файл в корне домена, URL без вложенных путей медиатеки или темы
  • HTTP 200, не 301→HTML и не мягкая 404 темы
  • Отдаётся текст, не верстка сайта
  • UTF-8, кириллица читается
  • В списке только абсолютные живые URL
  • Нет noindex-страниц и черновиков
  • В robots.txt файл не запрещён
  • Кэш сброшен после генерации
  • Работает один генератор, не два
  • Плагин обновлён (нет старых версий с известными дырами)
  • В первой версии 10–20 сильных URL, а не «весь сайт»

Если все пункты «да» — техническая часть закрыта. Дальше решает качество страниц, на которые вы указали.

Как llms.txt усиливает GEO, а не заменяет контент

Файл усиливает GEO только как указатель. Цитировать будут страницы с ясным тезисом, фактами, FAQ и человеческими формулировками — не пустую карту.

Реалистичная модель

Агент находит сайт → при умении читает llms.txt → ответ строится по содержимому страниц, а не по самому файлу-указателю.

10–20
URL в первой версии карты
HTTP 200
обязательный признак успеха

Практика: делайте файл как гигиену. Бюджет времени — в лонгриды, FAQ и автопубликацию качественных URL.

Связка с ответами ChatGPT, Perplexity и Яндекс Нейро

  1. Агент или инструмент с поиском находит ваш сайт.
  2. Если умеет — может заглянуть в llms.txt и взять curated URL.
  3. Ответ строится по содержимому страниц (и общим знаниям модели), а не по самому файлу-указателю.

Иногда боты вроде GPTBot/ClaudeBot/PerplexityBot действительно запрашивают файл — это ещё не значит, что он «влияет на ответы». Доля таких запросов по открытым замерам мала. Для Яндекс Нейро и русскоязычной выдачи по-прежнему важнее сильные страницы, индексируемые поиском, и понятная структура, чем наличие Markdown в корне.

Практический вывод: делайте llms.txt как гигиену и карту. Бюджет времени вкладывайте в лонгриды, FAQ, обновление фактов и автопубликацию качественных URL.

Какие URL контент-завода класть в индекс для AI

Алгоритм отбора на квартал:

  1. Выпишите все опубликованные лонгриды за период.
  2. Оставьте страницы с чётким H1, уникальной пользой и живыми внутренними ссылками.
  3. Добавьте продуктовые/обучающие URL и «Об авторе».
  4. На каждую ссылку напишите 1 строку «что цитировать».
  5. Обновите llms.txt (ручной diff или Generate Now в плагине).
  6. Проверьте HTTP 200 и чек-лист ошибок.

Так файл становится частью контент-завода: произвели материал → опубликовали → добавили в AI-карту. Без этого новый лонгрид существует для людей и поиска, но агенту его сложнее найти среди шума сайта.

Тильда и Битрикс — чем путь отличается от WordPress

Что переносится один в один, а что зависит от CMS

Переносится везде:

  • идея curated Markdown;
  • обязательный H1 и абсолютные URL;
  • проверка /llms.txt → 200 + текст;
  • аккуратность с robots.txt и кодировкой.

Зависит от CMS:

  • WordPress — плагины Yoast / Rank Math / Website LLMs.txt / AIOSEO или FTP в корень.
  • Тильда — обычно ручная загрузка файла в корень/файловый менеджер хостинга или кастомный способ отдать статику; готовых «как в WP» модулей меньше, зато ручной curated-файл часто даже удобнее.
  • Битрикс — файл в document root, следите за MIME: частая боль — HTML вместо plain text. Плагинная экосистема другая, чем у WP.

Если у вас несколько сайтов на разных CMS, спецификацию копируйте одну, а способ выкладки — разный. Не ищите «универсальную кнопку»: ищите стабильный URL с текстом.

FAQ по llms.txt на WordPress

Короткие ответы на частые вопросы перед публикацией файла

Обязателен ли файл для ранжирования в поиске

Нет. Для Google Search и его generative AI features файл не нужен и не учитывается. Для Яндекса это тоже не ranking-фактор в классическом смысле SEO. Файл — опциональная карта для систем, которые его поддерживают.

Сколько URL достаточно в первой версии

Ориентир — 10–20 сильных канонических страниц. Десятки и сотни автосписком обычно хуже: размывают смысл. Лучше обновить короткий список раз в квартал, чем один раз выгрузить весь блог.

Нужен ли отдельный файл для каждого языка/поддомена

Если языки живут на разных доменах или поддоменах (ru. / en.), логичнее свой /llms.txt на каждом каноническом хосте со своими абсолютными URL. На одном домене с языковыми префисками можно один файл с пометками в описаниях ссылок — главное, не смешивать дубли одной и той же статьи.

Дополнительно: генератор удобен, но не обязателен; llms-full.txt сразу не нужен; сам файл SEO не ломает — ломают Disallow на *.txt, HTML вместо текста и конфликты плагинов.

От файла к системе контента, которую цитируют нейросети

llms.txt — последний метр дорожки. До него нужны: регулярные лонгриды, понятные H2/H3, факты без воды, FAQ, обновление устаревших абзацев и аккуратная автопубликация в WordPress. Спрос на «нейросети для бизнеса» растёт не потому, что все внезапно ставят AI-файлы, а потому что компании ищут систему производства и доставки смысла — контент-завод, а не разовую кнопку.

Практичный цикл:

  1. Произвести сильную страницу.
  2. Опубликовать и проверить индексацию.
  3. Добавить URL в llms.txt с пояснением.
  4. Раз в квартал вычистить мёртвые ссылки.
  5. Не ждать «магии цитат» — измерять пользу по трафику, лидам и реальным упоминаниям.

Если выстраиваете такой цикл на WordPress и хотите связать генерацию, проверку и публикацию в один пайплайн — логичный следующий шаг не «ещё один плагин ради плагина», а система контента: от брифа до URL в AI-карте.

Автопубликация лонгридов и обновление списка URL

Минимальный регламент для команды или соло-маркетолога:

  • после каждой важной публикации — задача «добавить в llms.txt» (5 минут);
  • раз в месяц — Generate Now / сверка списка, если используете плагин;
  • раз в квартал — ревизия: убрать слабое, поднять лучшие материалы;
  • при смене домена или зеркала — переписать все абсолютные URL.

Так файл не гниёт. А агенты и люди получают одну и ту же правду: какие страницы на сайте действительно главные.

Что проверяли по источникам

  • спецификация формата на llmstxt.org;
  • позиция Google Search Central по AI-файлам и llms.txt;
  • возможности Website LLMs.txt, Rank Math, Yoast и AIOSEO;
  • открытые замеры Ahrefs о низкой частоте запросов к файлу;
  • типовые WP-ошибки: корень, MIME, кэш, Disallow, конфликты плагинов.
Beget — надёжный хостинг и VPS