Архивы таксономий в WordPress — это рубрики, метки и пользовательские таксономии вроде product_cat, portfolio_category или faq_category. На небольшом сайте они часто полезны, но на проектах с большим количеством тегов и служебных таксономий именно они начинают создавать мусор в индексе: тонкие страницы без уникального контента, дубли по смыслу и лишние URL в отчётах поисковиков.
Проблема не в самих архивах как классе страниц, а в том, что часть из них не несёт самостоятельной ценности для поиска. При этом удалять ссылки на них из шаблона не всегда нужно: пользователю и роботу может быть полезна внутренняя структура, а вот индексировать такие страницы — уже нет.
Когда архивы таксономий действительно стоит закрывать
Сначала стоит понять, что именно у вас мешает. Не все архивы нужно прятать от индексации. Если на странице рубрики есть нормальный текст, подборка материалов и понятная цель, она может ранжироваться и работать как посадочная. Но если это просто список записей без уникального контента, поисковик часто воспринимает такую страницу как слабую.
Типичные признаки проблемы
- в индексе много страниц меток, которые дублируют рубрики по смыслу;
- архивы пользовательских таксономий создаются плагином автоматически, но не заполняются контентом;
- в Search Console растёт число «Просканировано, но не проиндексировано» для архивов;
- в выдаче всплывают страницы, которые не должны быть посадочными;
- на сайте есть десятки или сотни тегов, созданных почти под каждый пост.
Если архив нужен только для навигации внутри сайта, а не как отдельная точка входа из поиска, его имеет смысл закрыть от индексации. Но важно не перепутать это с удалением страницы из сайта: ссылка и доступ для пользователя могут остаться, меняется именно отношение поисковика.
Диагностика: что проверить до правки robots или мета-тегов
Перед изменениями посмотрите, как архивы сейчас отдаются поисковым роботам и не конфликтуют ли настройки темы, SEO-плагина и кода. На практике чаще всего проблема возникает из-за того, что один инструмент ставит noindex, а другой потом переопределяет шаблон или canonical.
Проверка в браузере и в исходном коде
Откройте архив таксономии и посмотрите исходный HTML. Ищите:
<meta name="robots" content="noindex,follow">или похожий вариант;<link rel="canonical" ...>— он должен указывать на сам архив, если страница остаётся доступной;- нет ли редиректа на главную или на родительскую рубрику без явной причины.
Если у вас установлен SEO-плагин, проверьте его настройки для рубрик, меток и таксономий. Иногда достаточно отключить индексацию в интерфейсе, а иногда нужно отдельно убрать архивы меток или пользовательских таксономий.
Что посмотреть через WP-CLI или админку
Если есть доступ к консоли, полезно быстро проверить, какие таксономии вообще зарегистрированы в проекте. Это помогает не трогать лишнее.
wp taxonomy listКоманда покажет системные и пользовательские таксономии. Дальше уже можно решить, что закрывать: только post_tag, только служебные таксономии плагина или всё, кроме рубрик.
Рабочие способы отключить индексацию архивов таксономий
Есть три нормальных подхода: через SEO-плагин, через код темы или плагина, и через robots.txt. Последний вариант обычно не лучший для этой задачи, потому что запрет в robots.txt не решает проблему уже известных поисковику URL и не даёт корректного сигнала noindex.
| Способ | Когда подходит | Плюс | Минус |
|---|---|---|---|
| SEO-плагин | Если нужен быстрый и управляемый вариант | Без кода, удобно для редактора | Не всегда гибко для отдельных таксономий |
| Код через хук | Если нужна точечная настройка | Можно закрыть только нужные архивы | Нужно аккуратно тестировать |
| robots.txt | Только как дополнительная мера | Просто добавить правило | Не заменяет noindex |
Вариант 1: через SEO-плагин
Если у вас уже стоит SEO-плагин, начните с него. В популярных решениях можно отключить индексацию для рубрик, меток и некоторых архивов таксономий без правки шаблонов. Это самый безопасный путь, если сайт ведёт редактор или контент-менеджер.
Смысл настройки простой: архив остаётся доступным по URL, но в head добавляется noindex, а иногда и отключается вывод в XML-картах сайта. Это удобно, если вы не хотите, чтобы служебные страницы попадали в индекс.
Вариант 2: через код для конкретной таксономии
Если нужен точечный контроль, можно добавить фильтр в functions.php дочерней темы или в небольшой mu-plugin. Ниже пример для закрытия от индексации архивов одной пользовательской таксономии. Такой подход полезен, когда SEO-плагин не покрывает нужный сценарий или когда вы не хотите зависеть от его настроек.
<?php
add_filter( 'wp_robots', function( array $robots ) {
if ( is_tax( 'portfolio_category' ) ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
} );Этот код не ломает доступ к странице и не убирает ссылки. Он только меняет robots-мета для конкретного архива. Если у вас несколько таксономий, можно расширить условие:
<?php
add_filter( 'wp_robots', function( array $robots ) {
if ( is_tax( array( 'portfolio_category', 'faq_category' ) ) || is_tag() ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
} );Для рубрик используйте is_category(), для меток — is_tag(), для пользовательских архивов — is_tax(). Не вешайте это на все архивы подряд, если часть из них реально должна ранжироваться.
Вариант 3: убрать таксономию из XML-карты сайта
Если архив не должен индексироваться, логично не включать его и в sitemap. Это не обязательное условие, но так вы уменьшаете шум и ускоряете переобход полезных URL. В SEO-плагинах это обычно настраивается отдельно для рубрик, меток и custom taxonomies.
Если sitemap генерируется кодом, проверьте, что туда не попадают архивы, которые вы закрыли через noindex. Иначе поисковик будет тратить ресурсы на URL, которые вы сами просите не индексировать.
Пошаговое решение без лишнего риска
- Составьте список таксономий, которые реально нужны для поиска и навигации.
- Проверьте, какие из них уже имеют уникальный контент и трафик.
- Закройте от индексации только служебные и слабые архивы.
- Убедитесь, что canonical не указывает на другую страницу без причины.
- При необходимости уберите закрытые архивы из XML-карты сайта.
- Переобойдите страницы и проверьте реакцию поисковика.
Если вы работаете в команде, лучше сначала зафиксировать решение в чек-листе, чтобы не закрыть случайно важную посадочную страницу.
- Какие таксономии должны оставаться в индексе?
- Какие архивы используются только для фильтрации и навигации?
- Есть ли у архивов уникальные тексты, заголовки и описания?
- Не создаёт ли плагин дублирующие архивы по одной и той же сущности?
- Нужно ли обновить sitemap после изменения?
Как проверить, что решение сработало
После внедрения не ограничивайтесь просмотром страницы в браузере. Нужно проверить именно сигналы для поисковика.
Проверка в исходном коде
Откройте архив и убедитесь, что в head появился нужный robots-мета-тег. Для закрытого архива вы должны увидеть noindex, а не только отсутствие страницы в sitemap.
Проверка через Search Console
Если сайт подключён к Google Search Console, отправьте страницу на повторную проверку через инспекцию URL. Смотрите на:
- статус индексации;
- наличие
noindexв обнаруженных сигналах; - канонический URL;
- не осталась ли страница в карте сайта после изменения.
Если вы закрыли архивы меток, а в индексе они всё ещё висят, это нормально не сразу. Поисковику нужно время на переобход. Важно, чтобы новые сигналы были корректными и стабильными.
Проверка на уровне сайта
Пройдитесь по внутренним ссылкам. Архив может быть закрыт от индексации, но должен открываться для пользователя без ошибок 404 или 301 на главную. Если после правки вы видите редирект, значит, где-то в теме или плагине есть дополнительная логика, которую нужно убрать.
Частые ошибки и как их исправить
Закрыли архив в robots.txt вместо noindex
Это частая ошибка. Запрет в robots.txt не гарантирует удаление URL из индекса и не даёт поисковику корректный сигнал о том, что страницу не нужно учитывать. Если архив уже известен поиску, лучше использовать noindex.
Отключили индексацию всех таксономий подряд
Так можно случайно убрать из поиска полезные рубрики, которые реально приводят трафик. Исправление простое: верните индексацию для сильных архивов и закройте только слабые или служебные.
Оставили архив в sitemap
Это не критическая ошибка, но она создаёт лишний шум. Если вы уже решили, что архив не должен индексироваться, логично убрать его и из XML-карты сайта.
Сломали canonical или редиректами повели на главную
Иногда после вмешательства в тему архив начинает канонизироваться на другую страницу или редиректиться. Это мешает поисковику понять, что именно вы хотели сделать. Проверьте шаблоны темы, SEO-плагин и кастомные правила редиректов.
Безопасность и производительность: что учесть на живом сайте
Если вы вносите изменения кодом, не редактируйте functions.php основной темы на боевом сайте без бэкапа. Лучше использовать дочернюю тему или небольшой mu-plugin. Так вы не потеряете правку после обновления темы.
Для сайтов с большим количеством таксономий полезно держать логику в одном месте. Чем меньше разрозненных фильтров в разных плагинах, тем проще отлаживать поведение robots-меток и sitemap.
Если у вас уже есть плагин для SEO и чистки дублей, проверьте, не дублирует ли он часть этой логики. Например, в Clearfy Pro есть инструменты для технической чистки сайта и управления лишними элементами, но использовать их стоит только после проверки, как они взаимодействуют с вашим SEO-плагином. В таких задачах важнее предсказуемость, чем набор галочек.
Главный принцип здесь простой: закрывайте от индексации только то, что не должно быть посадочной страницей. Всё остальное лучше оставить доступным и измерить по факту, а не по ощущению.