GEO · WordPress · llmstxt.org
Как создать llms.txt для WordPress:пошаговый гайд по видимости в нейросетях
Спецификация, ручная заливка или плагин, llms-full.txt, проверка HTTP 200 и связка с GEO — без обещаний «ранжирования в ChatGPT»
Вы открыли сайт в браузере — и видите меню, статьи, кнопки. Нейросеть и ИИ-агент видят сайт иначе: они часто хватают куски страниц наугад. Файл llms.txt — это короткая «карта» в корне домена: какие страницы важны и о чём они. Ниже — как собрать такой файл на WordPress за один вечер, проверить HTTP 200 и не сломать SEO.
Коротко. llms.txt не заменяет сильный контент и не обещает место в ответах ChatGPT. Это low-cost порядок: curated-список URL для агентов и инструментов, которые файл умеют читать. Google Search этот файл игнорирует.
Зачем сайту файл llms.txt и чего он не обещает
llms.txt — предложение сообщества (сайт спецификации llmstxt.org): положить в корень домена Markdown-файл с названием проекта, кратким описанием и списком ключевых ссылок. Авторы спеки ориентируют файл прежде всего на сценарии «здесь и сейчас» — агент, IDE, чат с поиском, — а не на обязательное обучение моделей.
Маркер: простыми словами. llms.txt — это текстовая «оглавление» сайта для нейросетей: не весь каталог страниц, а короткий список того, что вы сами считаете главным.
Чего файл не делает:
- не является фактором ранжирования в Google и Яндексе;
- не гарантирует, что ChatGPT, Claude или Perplexity начнут цитировать ваш блог;
- не заменяет
robots.txt, карту сайта и нормальный HTML с понятными заголовками.
Позиция Google Search Central прямая: специальные AI-файлы и Markdown не нужны, чтобы попасть в поиск и в generative AI features Google; Search игнорирует llms.txt — наличие не помогает и не вредит. Держать файл можно «для других систем». Исследование Ahrefs по большой выборке доменов показало жёсткую реальность: у большинства валидных файлов за месяц было ноль запросов, а доля AI retrieval-ботов среди редких запросов крошечная. Вывод для практики: файл — дешёвая гигиена и карта для агентов, а не «кнопка цитат».
В русскоязычных гайдах иногда встречаются обещания вроде «+30–60% цитируемости за пару недель». Открытой методологии под такие цифры нет, они расходятся с данными Ahrefs и с позицией Google. В этой статье таких обещаний не будет.
Чем llms.txt отличается от robots.txt и sitemap.xml
Три файла в корне решают разные задачи. Их нельзя подменять друг другом.
| Файл | Задача | Формат | Кто читает | Статус |
|---|---|---|---|---|
| robots.txt | разрешить или запретить обход | директивы | любые краулеры | широкий стандарт |
| sitemap.xml | перечислить URL для поиска | XML | поисковики | стандарт discovery |
| llms.txt | curated-карта + смысл | Markdown | LLM и агенты (добровольно) | предложение llmstxt.org |
| llms-full.txt | расширенный дамп / полный текст | Markdown | ingest, RAG, docs | опциональный компаньон |
Маркер: простыми словами. Voluntary adoption значит: никто не обязан читать ваш llms.txt. Кто умеет — может открыть. Кто не умеет — просто пройдёт мимо. Это не «закон интернета», а договорённость.
Sitemap отвечает: «вот все URL, которые можно индексировать». llms.txt отвечает: «вот 10–20 страниц, с которых стоит начинать, если нужно понять сайт». robots.txt отвечает: «сюда ходить можно, сюда нельзя». Для GEO-видимости важны все три слоя плюс сам контент.
Маркер: простыми словами. GEO (Generative Engine Optimization) — это работа над тем, чтобы ваш материал чаще и точнее попадал в ответы нейросетей. AEO — близкий термин про ответы AI. Это не отдельный «магический файл», а качество страниц, структура, факты и понятные формулировки. Файл llms.txt лишь помогает агенту быстрее найти сильные URL.
Какие страницы стоит отдать нейросетям в первую очередь
Не тащите в файл весь блог. Спецификация как раз про кураторский обзор, а не про копию sitemap. Для владельца контент-завода на WordPress разумный старт — 10–20 канонических URL:
- Главная и ключевые продуктовые/курсовые страницы с ясным H1.
- Страница «Об авторе» / экспертности (E-E-A-T).
- 5–10 сильнейших лонгридов: агенты, автопубликация, SEO/GEO, автоматизация.
- FAQ или страница с частыми возражениями.
- Контакты / оффер в Telegram — если это каноническая точка входа.
К каждой ссылке — одна короткая пометка: что на странице и что можно цитировать. Абсолютные URL (https://ваш-домен.ru/...), без относительных путей вроде /blog/post.
Структура Markdown по спецификации llmstxt.org
Формат простой. Его можно набрать в любом текстовом редакторе и сохранить как llms.txt.
H1, краткое описание и список разделов с URL
По спецификации обязателен только H1 — имя сайта или проекта. Дальше рекомендуется:
- Блок с кратким summary (в Markdown это обычно цитата/
blockquote). - Свободный текст без новых заголовков до первых H2 (если нужен).
- Секции
## ...со списками ссылок вида: дефис, название в квадратных скобках, абсолютный URL в круглых, затем двоеточие и пояснение. - Секция
## Optional— низкий приоритет: клиенты с коротким контекстом могут её пропустить.
Пример каркаса:
# Название сайта или проекта
> Одной-двумя фразами: чем занимаетесь и для кого сайт.
## Основные страницы
- [Главная](https://example.ru/): о чём проект и кому полезен
- [Курс «Контент-завод»](https://example.ru/kurs/): программа и формат обучения
- [Об авторе](https://example.ru/ob-avtore/): экспертиза и кейсы
## Сильные материалы
- [Гайд по llms.txt](https://example.ru/llms-txt-wordpress-geo-gayd-2026/): как собрать файл на WordPress
- [Автопубликация в блог](https://example.ru/avtopublikaciya/): пайплайн лонгридов
## Optional
- [Архив блога](https://example.ru/blog/): полный список статей
Пример рабочего файла: что копировать, что править под себя
Копируйте структуру, не чужие URL. Под себя правьте:
- H1 — реальное имя бренда;
- summary — без маркетингового тумана («лучшие в мире»), лучше факт: ниша + аудитория;
- списки — только живые канонические страницы с кодом 200;
Optional— второстепенное, что жалко выкинуть, но не критично для первого знакомства.
Если пишете по-русски — сохраняйте файл в UTF-8 без лишнего BOM. Кириллица в llms.txt нормальна; ломается она из‑за кривой кодировки на сервере, а не из‑за языка.
От хаоса URL к кураторскому индексу
Сцена ниже — не hero, а мостик: WordPress отдаёт десятки страниц,
куратор выбирает 10–20 канонических URL, файл ложится в корень как
/llms.txt, агент читает карту и идёт по сильным материалам.
- Не sitemap — curated-список, а не «все URL подряд».
- Корень домена — HTTP 200 и абсолютные ссылки, без редиректа на PHP.
- GEO-гигиена — файл помогает найти сильные страницы, но не заменяет контент.
Дальше — три пути внедрения на WordPress: руками, плагином или SEO-модулем.
Три пути внедрения на WordPress
На практике у владельца WordPress есть три рабочих маршрута. Выбор зависит от того, какие SEO-плагины уже стоят и нужен ли вам контроль списка URL.
Ручная заливка в корень домена
Подходит, если хостинг даёт доступ к файлам (файловый менеджер Beget, SFTP/SSH) и вы хотите короткий curated-список без автогенерации.
Создайте файл
Создайте llms.txt на компьютере в UTF-8 по каркасу выше.
Залейте в корень
Туда же, где лежат wp-config.php и обычно robots.txt. Адрес: https://ваш-домен.ru/llms.txt, не медиатека и не папка темы.
Откройте в инкогнито
Должен открыться текст, не страница темы WordPress.
Проверьте заголовки
Желательно text/plain и кодировка UTF-8.
Сбросьте кэш
Если стоит WP Super Cache, W3 Total Cache или CDN — сбросьте и откройте файл снова.
Признак успеха: по адресу /llms.txt код HTTP 200, видно ваш H1 первой строкой, нет шапки темы и меню сайта.
Типичные ошибки новичка:
- Файл лежит в медиатеке или в папке темы → агент ищет корень и получает 404.
- Сервер отдаёт HTML «мягкой» 404-страницы темы → для агента это мусор.
- В
robots.txtстоит запрет вродеDisallow: /*.txt→ добавьте явное разрешение на/llms.txt.
Маркер: простыми словами. MIME (Content-Type) — это «ярлык» ответа сервера: «я отдаю текст» или «я отдаю HTML-страницу». Агенту нужен текст. Если ярлык и содержимое — HTML-шаблон темы, карта бесполезна.
Плагин генерации Website LLMs.txt и SEO-модули
Если не хотите возиться с FTP, на WordPress есть готовые пути:
- Website LLMs.txt — генерирует
/llms.txtи опционально/llms-full.txt, умеет учитывать noindex из Yoast / Rank Math / SEOPress / AIOSEO, расписание обновления, fallback через rewrite, если корень недоступен на запись. В FAQ плагина прямо сказано: видимость в ChatGPT/Claude/Perplexity не гарантируется. Обновляйте плагин: в старых версиях была уязвимость XSS (CVE-2026-6711), патч с 8.2.7. - Rank Math — модуль LLMS Txt: тумблер в Dashboard, редактирование файла, типы записей/таксономии, лимит (по умолчанию до 100), исключение noindex. В базе знаний Rank Math честно пишет: это proposal, не официальный стандарт, adoption ограничен.
- Yoast — генерация
llms.txtв один клик, auto/manual выбор ключевого контента, preview; на официальной странице фичи позиционируется как доступная функция AI tools (проверяйте UI своей версии на момент настройки). - AIOSEO — вкладка Sitemaps → LLMs.txt: включает короткий и полный файл, title/description, лимиты и exclude.
Важно: не включайте сразу два генератора (например Yoast + Website LLMs.txt). Получите конфликт, кто «владеет» URL /llms.txt.
Плагины удобны из России так же, как обычные SEO-плагины WordPress: ставятся из админки или с ru.wordpress.org. Оплата зарубежных SaaS здесь не нужна — достаточно локального WP на российском хостинге.
Когда достаточно генератора, а когда лучше руками
| Ситуация | Лучший путь |
|---|---|
| Уже стоит Rank Math / Yoast / AIOSEO и устраивает их список | Включить встроенный модуль, подчистить лишнее |
Нужен и короткий индекс, и llms-full.txt, плюс расписание | Website LLMs.txt или AIOSEO |
| Хотите ровно 12 curated URL под контент-завод | Ручной файл или ручная правка после генерации |
| Корень read-only / «No LLMS.txt in root» | Плагин с virtual serve / Generate Now + проверка cron |
| Нет времени разбираться в админке | Генератор + потом ручная чистка до 10–20 ссылок |
Автосписок на десятки и сотни URL выглядит «солидно», но спорит с идеей кураторства. Лучше короткий сильный список, чем sitemap в Markdown-одежде.
Когда нужен llms-full.txt и как не сломать SEO
Короткий индекс vs полный дамп контента
Маркер: простыми словами. llms-full.txt — «толстый» компаньон: расширенный экспорт или почти полный текст важных страниц. Его включают, если нужен корпус для docs/RAG/агента. Для первой версии сайта чаще хватает короткого llms.txt.
Короткий файл — карта. Полный — склад. Не путайте. Если включили llms-full.txt плагином:
- убедитесь, что URL
https://домен.ru/llms-full.txtтоже отдаёт текст с кодом 200; - не дублируйте в полном файле черновики, noindex и служебные страницы;
- помните: больший объём ≠ больше цитат.
robots.txt, кэш, MIME и редирект на PHP — типичные ловушки
Чек-лист «не сломать SEO и доступ»:
- robots.txt. Если где-то запрещены
*.txt, добавьтеAllow: /llms.txt(и при необходимости/llms-full.txt). Самllms.txtне заменяет robots. - Кэш и CDN. После первой генерации старый 404 или HTML может «залипнуть». Сбросьте кэш.
- MIME и UTF-8. Плагины чинили BOM и
charset=utf-8как раз из‑за кириллицы и валидаторов. Если буквы «кракозябры» — проблема кодировки. - Редирект на PHP. Иногда
/llms.txtуводит на скрипт или мягкую 404 темы. Для агента важен стабильный текстовый ответ, а не красивая HTML-заглушка. - Путь
.well-known. Отдельные эксперименты кладут файлы в/.well-known/, но канон спеки — корень/llms.txt. Не усложняйте без нужды. - Двойные плагины. Один владелец URL
/llms.txt.
SEO-фундамент (индексация, скорость, структурированные данные, понятный HTML) важнее AI-файла. Google прямо говорит: для Search важнее качество страниц, а не новый Markdown в корне.
Как проверить, что файл реально открывается
HTTP 200, канонический URL и валидатор
Пошаговая проверка после публикации:
- Откройте
https://ваш-домен.ru/llms.txtв браузере. - Убедитесь: статус 200, виден текст, первая строка —
# .... - Сравните с каноническим доменом (www / без www, http / https) — не должно быть цепочки редиректов на HTML-ошибку.
- Прогоните файл через любой онлайн-валидатор (их ищут как «валидатор llms txt»). Смотрите на H1 и абсолютные URL.
- Если используете плагин — нажмите Generate Now и убедитесь, что WP-Cron жив (иначе расписание не обновит файл).
Маркер: простыми словами. Валидатор — это проверка «файл похож на правильный llms.txt»: есть H1, ссылки читаются, нет явного мусора. Это не гарантия, что нейросеть вас процитирует.
Отдельно: в проверках Agentic Browsing / Lighthouse отсутствие llms.txt часто даёт N/A, а серверная ошибка на URL файла — уже проблема. Это чек-лист доступности, не ranking-сигнал.
Чек-лист ошибок после публикации
- Файл в корне домена, URL без вложенных путей медиатеки или темы
- HTTP 200, не 301→HTML и не мягкая 404 темы
- Отдаётся текст, не верстка сайта
- UTF-8, кириллица читается
- В списке только абсолютные живые URL
- Нет noindex-страниц и черновиков
- В
robots.txtфайл не запрещён - Кэш сброшен после генерации
- Работает один генератор, не два
- Плагин обновлён (нет старых версий с известными дырами)
- В первой версии 10–20 сильных URL, а не «весь сайт»
Если все пункты «да» — техническая часть закрыта. Дальше решает качество страниц, на которые вы указали.
Как llms.txt усиливает GEO, а не заменяет контент
Файл усиливает GEO только как указатель. Цитировать будут страницы с ясным тезисом, фактами, FAQ и человеческими формулировками — не пустую карту.
Реалистичная модель
Агент находит сайт → при умении читает llms.txt → ответ строится по содержимому страниц, а не по самому файлу-указателю.
Практика: делайте файл как гигиену. Бюджет времени — в лонгриды, FAQ и автопубликацию качественных URL.
Связка с ответами ChatGPT, Perplexity и Яндекс Нейро
- Агент или инструмент с поиском находит ваш сайт.
- Если умеет — может заглянуть в
llms.txtи взять curated URL. - Ответ строится по содержимому страниц (и общим знаниям модели), а не по самому файлу-указателю.
Иногда боты вроде GPTBot/ClaudeBot/PerplexityBot действительно запрашивают файл — это ещё не значит, что он «влияет на ответы». Доля таких запросов по открытым замерам мала. Для Яндекс Нейро и русскоязычной выдачи по-прежнему важнее сильные страницы, индексируемые поиском, и понятная структура, чем наличие Markdown в корне.
Практический вывод: делайте llms.txt как гигиену и карту. Бюджет времени вкладывайте в лонгриды, FAQ, обновление фактов и автопубликацию качественных URL.
Какие URL контент-завода класть в индекс для AI
Алгоритм отбора на квартал:
- Выпишите все опубликованные лонгриды за период.
- Оставьте страницы с чётким H1, уникальной пользой и живыми внутренними ссылками.
- Добавьте продуктовые/обучающие URL и «Об авторе».
- На каждую ссылку напишите 1 строку «что цитировать».
- Обновите
llms.txt(ручной diff или Generate Now в плагине). - Проверьте HTTP 200 и чек-лист ошибок.
Так файл становится частью контент-завода: произвели материал → опубликовали → добавили в AI-карту. Без этого новый лонгрид существует для людей и поиска, но агенту его сложнее найти среди шума сайта.
Тильда и Битрикс — чем путь отличается от WordPress
Что переносится один в один, а что зависит от CMS
Переносится везде:
- идея curated Markdown;
- обязательный H1 и абсолютные URL;
- проверка
/llms.txt→ 200 + текст; - аккуратность с
robots.txtи кодировкой.
Зависит от CMS:
- WordPress — плагины Yoast / Rank Math / Website LLMs.txt / AIOSEO или FTP в корень.
- Тильда — обычно ручная загрузка файла в корень/файловый менеджер хостинга или кастомный способ отдать статику; готовых «как в WP» модулей меньше, зато ручной curated-файл часто даже удобнее.
- Битрикс — файл в document root, следите за MIME: частая боль — HTML вместо plain text. Плагинная экосистема другая, чем у WP.
Если у вас несколько сайтов на разных CMS, спецификацию копируйте одну, а способ выкладки — разный. Не ищите «универсальную кнопку»: ищите стабильный URL с текстом.
FAQ по llms.txt на WordPress
Короткие ответы на частые вопросы перед публикацией файла
Обязателен ли файл для ранжирования в поиске
Нет. Для Google Search и его generative AI features файл не нужен и не учитывается. Для Яндекса это тоже не ranking-фактор в классическом смысле SEO. Файл — опциональная карта для систем, которые его поддерживают.
Сколько URL достаточно в первой версии
Ориентир — 10–20 сильных канонических страниц. Десятки и сотни автосписком обычно хуже: размывают смысл. Лучше обновить короткий список раз в квартал, чем один раз выгрузить весь блог.
Нужен ли отдельный файл для каждого языка/поддомена
Если языки живут на разных доменах или поддоменах (ru. / en.), логичнее свой /llms.txt на каждом каноническом хосте со своими абсолютными URL. На одном домене с языковыми префисками можно один файл с пометками в описаниях ссылок — главное, не смешивать дубли одной и той же статьи.
Дополнительно: генератор удобен, но не обязателен; llms-full.txt сразу не нужен; сам файл SEO не ломает — ломают Disallow на *.txt, HTML вместо текста и конфликты плагинов.
От файла к системе контента, которую цитируют нейросети
llms.txt — последний метр дорожки. До него нужны: регулярные лонгриды, понятные H2/H3, факты без воды, FAQ, обновление устаревших абзацев и аккуратная автопубликация в WordPress. Спрос на «нейросети для бизнеса» растёт не потому, что все внезапно ставят AI-файлы, а потому что компании ищут систему производства и доставки смысла — контент-завод, а не разовую кнопку.
Практичный цикл:
- Произвести сильную страницу.
- Опубликовать и проверить индексацию.
- Добавить URL в
llms.txtс пояснением. - Раз в квартал вычистить мёртвые ссылки.
- Не ждать «магии цитат» — измерять пользу по трафику, лидам и реальным упоминаниям.
Если выстраиваете такой цикл на WordPress и хотите связать генерацию, проверку и публикацию в один пайплайн — логичный следующий шаг не «ещё один плагин ради плагина», а система контента: от брифа до URL в AI-карте.
Автопубликация лонгридов и обновление списка URL
Минимальный регламент для команды или соло-маркетолога:
- после каждой важной публикации — задача «добавить в llms.txt» (5 минут);
- раз в месяц — Generate Now / сверка списка, если используете плагин;
- раз в квартал — ревизия: убрать слабое, поднять лучшие материалы;
- при смене домена или зеркала — переписать все абсолютные URL.
Так файл не гниёт. А агенты и люди получают одну и ту же правду: какие страницы на сайте действительно главные.
Что проверяли по источникам
- спецификация формата на llmstxt.org;
- позиция Google Search Central по AI-файлам и
llms.txt; - возможности Website LLMs.txt, Rank Math, Yoast и AIOSEO;
- открытые замеры Ahrefs о низкой частоте запросов к файлу;
- типовые WP-ошибки: корень, MIME, кэш, Disallow, конфликты плагинов.
