Если на сайте много тегов, их архивы часто превращаются в набор слабых страниц: одинаковые списки записей, мало уникального текста, почти нулевая ценность для поиска. В такой ситуации закрыть архивы тегов от индексации — нормальная техническая мера, если вы хотите сократить мусор в индексе и оставить поисковикам только полезные страницы.
Сделать это можно несколькими способами. Самый безопасный и предсказуемый вариант для большинства сайтов — поставить для архивов тегов мета-робот noindex,follow. Тогда страница может открываться для пользователей, но поисковая система не будет держать её в индексе. Если вам нужно не только убрать страницу из индекса, но и запретить её обход, тогда используют robots.txt, но это уже другой сценарий и подходит не всем.
Когда архивы тегов действительно стоит закрывать
Не каждый сайт должен прятать теги от поиска. Архивы тегов полезны, если они сами по себе дают ценность: у тега есть понятная тема, на странице много релевантных материалов, а сам архив помогает пользователю быстро перейти к нужным статьям. Но на практике чаще встречается другое:
- теги дублируют рубрики или слишком общие темы;
- по одному тегу висит 1–2 записи, а иногда и одна;
- в архиве нет уникального описания, только список постов;
- в индексе копятся десятки или сотни слабых страниц без трафика;
- поисковик тратит обход на малополезные URL вместо важных страниц.
Если вы видите такую картину, закрытие тегов от индексации обычно оправдано. Но если у вас контентный проект, где теги реально собирают тематические подборки и получают переходы, сначала проверьте статистику в Search Console и аналитику. Иногда лучше не закрывать все архивы подряд, а оставить только те, что действительно работают.
Самый практичный способ: noindex для архивов тегов
Для WordPress это обычно лучший вариант. Страница тега остаётся доступной для посетителей, но поисковик получает сигнал не включать её в индекс. При этом ссылки на записи внутри архива продолжают работать, а внутренний вес не обрывается, если вы используете follow.
Есть два распространённых пути: через SEO-плагин или вручную через код. Если на сайте уже стоит SEO-плагин, проще и безопаснее сделать настройку там. Если плагина нет или вы хотите точечно управлять логикой, можно добавить фильтр в тему или мини-плагин.
Вариант через SEO-плагин
В большинстве SEO-плагинов для WordPress есть настройка индексации архивов таксономий. Для тегов обычно нужно открыть раздел, связанный с архивами таксономий, и отключить индексацию тегов или задать для них noindex. Названия пунктов зависят от плагина, но логика одна: архивы тегов должны получить мета-робот с запретом на индексирование.
Этот способ удобен тем, что не требует правки кода и меньше зависит от темы. Если вы ведёте сайт не один и не хотите, чтобы настройка сломалась после обновления шаблона, это обычно предпочтительнее ручного решения.
Вариант через код
Если вы не используете SEO-плагин или хотите закрыть от индексации только архивы тегов, можно добавить фильтр в functions.php дочерней темы либо в собственный мини-плагин. Ниже пример для WordPress, который меняет robots meta на страницах тегов:
add_filter('wp_robots', function ($robots) {
if (is_tag()) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
});Этот код работает на современных версиях WordPress, где используется API wp_robots. Если у вас старый сайт с устаревшей темой или плагинами, поведение может отличаться, поэтому после внедрения обязательно проверьте исходный код страницы. Не вставляйте такой код в родительскую тему: после обновления он может исчезнуть.
Если хотите закрыть не только архивы тегов, но и отдельные страницы конкретных тегов, условие is_tag() как раз подходит. Оно сработает на всех tag archive pages, а не на страницах записей или других таксономий.
Когда лучше использовать robots.txt, а когда не стоит
Запрет в robots.txt часто путают с закрытием от индексации, но это не одно и то же. Если вы добавите правило Disallow для архивов тегов, поисковый робот не сможет их обходить, но URL всё равно может остаться в индексе, если на него есть внешние или внутренние ссылки. Кроме того, поисковик не увидит мета-робот на самой странице, потому что не сможет её загрузить.
Поэтому для задачи «убрать теги из индекса» robots.txt обычно не лучший первый выбор. Он полезен, когда нужно сократить обход технических разделов, но для тегов чаще нужен именно noindex. Если вы уже закрыли архивы в robots.txt, а они всё ещё висят в поиске, это ожидаемое поведение: робот не получил явного сигнала на удаление из индекса.
Исключение — когда вы сознательно не хотите, чтобы поисковик вообще заходил на эти страницы, например на очень крупном сайте с большим числом бесполезных архивов и ограниченным crawl budget. Но даже в таком случае лучше сначала оценить последствия, потому что вы можете усложнить переобход полезных страниц, если правила составлены слишком широко.
Что проверить после настройки
После изменения не стоит считать задачу решённой только потому, что вы сохранили настройки. Нужно убедиться, что поисковый робот действительно видит нужный сигнал.
- Откройте страницу любого тега в браузере и посмотрите исходный код или ответ сервера.
- Проверьте, что в HTML есть мета-робот с
noindex. В зависимости от реализации это может быть тег в<head>или HTTP-заголовокX-Robots-Tag. - Если вы используете Google Search Console, отправьте URL на проверку через инструмент проверки страницы и посмотрите, как робот видит страницу.
- Убедитесь, что важные записи и рубрики не получили случайно такой же запрет.
Если у вас кэш на сайте, изменения могут не отобразиться сразу. После настройки очистите кэш плагина, серверный кэш и, если используется CDN, его кэш тоже. Иначе вы проверите старую версию страницы и решите, что настройка не сработала.
Какие ошибки встречаются чаще всего
Самая частая ошибка — закрыть архивы тегов в robots.txt и ждать, что они исчезнут из индекса сами. Для уже проиндексированных страниц это ненадёжный путь. Вторая типичная проблема — поставить noindex только в одном месте, а потом другой плагин SEO или тема перезаписывает мета-данные. На WordPress это бывает, если одновременно включены несколько инструментов, которые управляют robots meta.
Ещё одна ошибка — закрыть все теги без разбора, а потом обнаружить, что часть из них приносила переходы и помогала навигации. Если сайт большой, сначала посмотрите отчёты по страницам тегов и закройте в первую очередь пустые, дублирующие и бесполезные архивы. Иногда достаточно оставить открытыми только несколько тематических тегов, а остальные убрать из индекса.
Если вы хотите не только закрыть теги, но и навести порядок в дублях и служебных страницах WordPress, удобно делать это через один SEO-инструмент, а не собирать настройку из нескольких плагинов. Например, в Clearfy Pro есть набор функций для чистки сайта и управления дублями: https://wpshop.ru/plugins/clearfy. Но даже в этом случае важно понимать, что именно вы отключаете, и проверять результат после изменений.
Что выбрать в итоге
Если задача звучит именно как «закрыть от индексации архивы тегов в WordPress», самый рабочий вариант — noindex,follow для tag archive pages. Для большинства сайтов это решает проблему мусорных страниц без лишних побочных эффектов. Через SEO-плагин это сделать проще, через код — точнее, если вам нужно тонкое управление.
Коротко по выбору:
- нужен простой и безопасный способ — настройка в SEO-плагине;
- нужен контроль без лишних плагинов — фильтр
wp_robotsв дочерней теме или мини-плагине; - нужно ограничить обход, а не только индекс —
robots.txt, но только если вы понимаете последствия; - нужно убрать уже проиндексированные теги — сначала
noindex, потом проверка в Search Console и ожидание переобхода.
Если подойти к задаче аккуратно, архивы тегов перестанут засорять индекс, а сайт сохранит только те страницы, которые действительно имеют смысл для поиска и пользователей.