Noindex: как закрыть страницу от индексации в Яндексе и Google
Александр Каширин
August 21, 2026
noindex — директива для поисковых роботов, которая запрещает добавлять страницу или другой ресурс в поисковый индекс. Она нужна для служебных, временных, дублирующихся и малополезных URL, которые должны оставаться доступными пользователям и роботам, но не должны показываться в результатах поиска.
Ошибочная установка noindex способна удалить из поиска важную категорию, карточку товара или весь сайт. Обратная ошибка — отсутствие директивы на фильтрах, внутреннем поиске и технических страницах — создаёт дубли, раздувает индекс и мешает поисковой системе сосредоточиться на полезных URL. Поэтому управлять индексацией нужно не отдельным тегом, а согласованной системой сигналов: кодом ответа, доступностью обхода, noindex, canonical, внутренними ссылками и sitemap.xml.
В руководстве разберём синтаксис meta robots и X-Robots-Tag, различия между запретом обхода и запретом индексации, правила для Google и Яндекса, типичные конфликты и безопасный порядок удаления или возврата страницы в поиск.
Содержание
- Что такое noindex
- Когда использовать noindex
- Когда noindex применять нельзя
- Meta robots: синтаксис и примеры
- X-Robots-Tag
- Noindex и robots.txt
- Noindex и canonical
- Noindex и sitemap.xml
- Google и Яндекс
- Как проверить noindex
- Как убрать страницу из поиска
- Как вернуть страницу в индекс
- Настройка в CMS и фреймворках
- Практические сценарии
- Массовый аудит и мониторинг
- Типичные ошибки
- Чек-лист
- FAQ
- Вывод
Что такое noindex: как он работает
Поисковая система проходит несколько этапов: обнаруживает URL, добавляет его в очередь, загружает документ, анализирует заголовки и HTML, определяет канонический адрес и принимает решение об индексации. Директива noindex применяется после того, как робот получил ответ сервера и смог прочитать её.
Упрощённая последовательность выглядит так:
Обнаружение URL → обход → чтение noindex → исключение из индексаКлючевой момент: robots.txt управляет доступом к обходу, а
noindex— присутствием документа в индексе. Чтобы выполнитьnoindex, робот должен иметь возможность запросить URL.
Noindex не защищает конфиденциальные данные
Важно:
noindexне защищает конфиденциальные данные. Для личного кабинета, административной панели и документов клиентов необходимы авторизация, разграничение прав и корректная серверная защита.
Noindex не экономит обход автоматически
Робот периодически возвращается к закрытому URL, чтобы проверить, не изменилась ли директива. Если на сайте миллионы бесполезных комбинаций параметров, одного noindex недостаточно. Сначала ограничивают появление технических ссылок, нормализуют параметры и архитектуру, затем используют подходящие правила обхода. Подробнее распределение ресурсов разобрано в статье про Crawl Budget.
Noindex не удаляет страницу мгновенно
Если URL уже находится в поиске, он исчезнет после повторного обхода и обработки. Срок зависит от частоты сканирования, размера сайта и значимости страницы. Для срочных случаев используют инструменты временного удаления в панелях вебмастеров, но они не заменяют постоянный технический сигнал.
Когда стоит использовать noindex
Директива полезна, когда документ нужен пользователю или системе, но не обладает самостоятельной поисковой ценностью.
Результаты внутреннего поиска
Страницы вида /search/?q=... создают почти бесконечное число комбинаций. Их содержание меняется, часто дублирует категории и может включать пустые результаты. Обычно такие URL закрывают от индексации и не добавляют в sitemap.
Корзина, оформление заказа и личный кабинет
Корзина, избранное, авторизация, восстановление пароля и этапы оформления заказа не являются посадочными страницами. Они должны работать для посетителей, но не конкурировать с товарными и категорийными URL.
Технические фильтры и сортировки
Не каждый фильтр нужно закрывать. Полезные статические подборки с уникальным спросом могут индексироваться. Но комбинации ?sort=price, ?view=list, служебные параметры и пустые пересечения обычно не дают новой ценности.
Временные страницы
Тестовые версии, предпросмотры, внутренние отчёты и промежуточные посадочные страницы можно закрыть на период подготовки. Важно удалить директиву перед публикацией и включить проверку в релизный процесс.
Дубли, которые должны оставаться доступными
Иногда URL нельзя перенаправить или удалить: печатная версия, техническое представление, отдельный шаг интерфейса. noindex предотвращает участие такой страницы в поиске. Но для обычных дублей чаще предпочтительны единый URL, 301-редирект или корректный canonical.
Страницы с тонким служебным содержанием
Списки с одной записью, пустые теги, пользовательские профили без публичной ценности и системные архивы могут создавать слабую зону сайта. Решение принимают по типу шаблона, а не вручную для каждого URL.
Когда noindex применять нельзя
Не закрывайте страницу только потому, что она временно не ранжируется. Отсутствие позиций не означает, что URL бесполезен. Сначала проверьте интент, качество контента, внутренние ссылки, техническую доступность и каноничность.
Вместо удаления страницы
Если материал удалён навсегда и замены нет, сервер должен вернуть 404 или 410. Сочетание 200 OK и noindex оставляет поисковику необходимость регулярно перепроверять URL. Если есть точная замена, используйте 301-редирект.
Для канонических посадочных страниц
Категории, услуги, статьи и товары, которые должны привлекать органический трафик, не должны иметь noindex. Это кажется очевидным, но директива часто наследуется из тестовой среды, шаблона или глобальной настройки CMS.
Для пагинации без анализа
Автоматическое закрытие всех страниц пагинации может ухудшить обнаружение карточек и старых публикаций. Сначала обеспечьте альтернативные внутренние ссылки и оцените роль пагинации в архитектуре.
Для борьбы с кражей контента
noindex удалит из поиска вашу страницу, а не чужую копию. Для защиты авторства нужны быстрый обход, внутренние ссылки, доказуемая дата публикации и работа с нарушителями.
Meta robots: синтаксис и примеры
Самый распространённый способ — тег в секции <head> HTML-документа:
<meta name="robots" content="noindex, follow">robots означает, что правило адресовано всем поддерживающим его поисковым роботам. noindex запрещает индексирование. follow разрешает переходить по ссылкам на странице.
Noindex, follow
<meta name="robots" content="noindex, follow">Подходит, когда страницу не нужно показывать в поиске, но ссылки на ней остаются полезной частью архитектуры. Современные поисковики могут со временем реже обходить URL, который долго закрыт от индексации, поэтому нельзя рассчитывать на него как на постоянный источник ссылочного веса.
Noindex, nofollow
<meta name="robots" content="noindex, nofollow">Запрещает индексацию и просит не переходить по ссылкам. Используйте только при понятной причине. Глобальное nofollow на служебных страницах может мешать обнаружению нужных URL.
Отдельные правила для роботов
<meta name="googlebot" content="noindex, follow">
<meta name="yandex" content="index, follow">Разные директивы усложняют поддержку. Их стоит применять лишь при реальной задаче и документированной политике. Если одновременно присутствует общее и специальное правило, поисковая система учитывает наиболее подходящую для своего робота директиву, а конфликтующие ограничения могут трактоваться консервативно.
Регистр и разделители
Обычно регистр не важен, а директивы разделяют запятыми. Для поддержки и аудита лучше придерживаться единого понятного формата:
<meta name="robots" content="noindex, follow">Не размещайте тег после закрывающего </head> и не создавайте несколько противоречащих тегов разными компонентами приложения.
X-Robots-Tag: для PDF, изображений и других файлов
HTML-тег невозможно вставить в PDF, изображение или документ. Для таких ресурсов используется HTTP-заголовок:
X-Robots-Tag: noindexЗаголовок подходит и для HTML, если управлять правилами удобнее на уровне сервера. Его можно настроить в Nginx, Apache, приложении или CDN.
Пример для Nginx:
location /private-pdf/ {
add_header X-Robots-Tag "noindex, nofollow" always;
}Пример для Apache:
<FilesMatch "\.pdf$">
Header set X-Robots-Tag "noindex"
</FilesMatch>Проверяйте заголовок не только в конфигурации, но и в реальном ответе:
curl -I https://example.com/document.pdfВажно учитывать кэш CDN. После изменения конфигурации старый заголовок может сохраняться до очистки или истечения TTL.
Noindex и robots.txt: почему их нельзя путать
Disallow в robots.txt запрещает обход указанного пути. Он не является надёжной директивой удаления из индекса. Если поисковая система знает URL по внешним или внутренним ссылкам, адрес иногда может отображаться без нормального фрагмента, потому что робот не получил содержимое.
Главный конфликт выглядит так:
- В HTML установили
noindex. - В robots.txt запретили обход этого же URL.
- Робот не может загрузить HTML.
- Следовательно, он не видит
noindex.
Правильная последовательность: разрешите обход, отдайте
200 OKсnoindexи дождитесь повторного сканирования. Только после подтверждённого исключения решайте, нужен ли отдельный запрет обхода технического раздела.
Не используйте устаревшие неофициальные конструкции Noindex: в robots.txt. Для запрета индексирования применяются поддерживаемые meta robots и X-Robots-Tag.
Noindex и canonical: разные задачи
Не смешивайте задачи:
canonicalсообщает предпочтительную версию среди похожих URL, аnoindexпросит исключить документ. Их одновременное использование создаёт смешанный сигнал:
<meta name="robots" content="noindex, follow">
<link rel="canonical" href="https://example.com/main-page/">Поисковая система может исключить первый URL, но не обязана переносить все его сигналы на canonical. Если требуется консолидация дублей, обычно используют canonical без noindex. Если страница не должна существовать отдельно и доступна точная замена, надёжнее 301-редирект.
Комбинация допустима как временное состояние во время миграции только при чётком плане и мониторинге. Постоянная стратегия должна давать однозначный ответ: индексировать каноническую версию, перенаправить дубль или исключить служебную страницу.
Noindex и sitemap.xml
XML-карта должна содержать канонические индексируемые URL с ответом 200 OK. Добавлять туда страницы с noindex нелогично: sitemap рекомендует индексирование, а директива запрещает его.
Последствия конфликта:
- предупреждения в панелях вебмастеров;
- искажённая статистика отправленных и индексированных URL;
- лишние повторные обходы;
- сложная диагностика массовых проблем;
- снижение доверия к
lastmodи составу карты.
Правило sitemap: после установки
noindexудалите URL из sitemap при ближайшей генерации. Это не мешает поисковику повторно обойти известную страницу и прочитать директиву.
Noindex в Google и Яндексе
Обе поисковые системы поддерживают meta robots noindex и X-Robots-Tag. Базовая стратегия одинакова: URL должен быть доступен роботу, сервер должен вернуть корректный ответ, а директива — присутствовать в полученном HTML или заголовке.
Google Search Console
Используйте проверку URL. В отчёте можно увидеть доступность сканирования, разрешение индексирования, выбранный canonical и дату последнего обхода. Если Google показывает старую версию, запросите повторную проверку после публикации изменения.
Отчёт «Страницы» может группировать URL как исключённые тегом noindex. Это нормальный статус для намеренно закрытых документов. Проблема возникает, если в группе оказались коммерческие или информационные посадочные страницы.
Яндекс Вебмастер
Проверяйте «Проверку URL» и раздел индексирования. Яндекс должен получить актуальный документ и увидеть директиву. Для переобхода используйте соответствующий инструмент, но учитывайте лимиты и не отправляйте тысячи URL вручную вместо исправления шаблона.
Старый HTML-тег Яндекса
В русскоязычном SEO термином noindex иногда называют конструкцию, которая исторически использовалась для закрытия фрагмента текста:
<!--noindex-->фрагмент<!--/noindex-->Это не то же самое, что meta robots noindex. Современную задачу исключения всей страницы решайте директивой robots. Не стройте архитектуру на попытках скрыть отдельные предложения от поисковой системы.
Как проверить noindex на странице
Проверка должна охватывать исходный HTML, HTTP-заголовки и версию, которую получает поисковый робот.
Исходный код
Откройте исходный код страницы и найдите:
noindexНе ограничивайтесь DOM в инструментах разработчика. JavaScript может добавлять или удалять тег после загрузки, а робот может получить другую версию. Для SSR и статической генерации проверяйте готовый HTML сборки.
Командная строка
curl -I https://example.com/page/
curl -s https://example.com/page/ | grep -i noindexПервая команда показывает HTTP-заголовки, вторая ищет директиву в HTML. Дополнительно проверьте код ответа, редиректы и итоговый URL.
Краулер
При массовом аудите соберите поля:
- URL;
- код ответа;
- indexability;
- meta robots;
- X-Robots-Tag;
- canonical;
- разрешение robots.txt;
- наличие в sitemap;
- количество внутренних ссылок.
Так можно быстро найти индексируемые шаблоны с noindex, конфликтующие сигналы и страницы, случайно закрытые целым разделом.
Панели вебмастеров
Фактическая директива в коде и состояние поискового индекса — разные уровни проверки. После технического аудита убедитесь, что поисковая система уже переобошла страницу и обработала изменения.
Как правильно убрать страницу из поиска
Выберите метод по задаче.
| Ситуация | Рекомендуемое решение |
|---|---|
| Страница нужна пользователям, но не поиску | noindex, follow |
| Есть точная постоянная замена | 301-редирект |
| Страница удалена без замены | 404 или 410 |
| Нужно закрыть конфиденциальные данные | Авторизация и ограничение доступа |
| Нужно срочно скрыть результат | Временное удаление + постоянное техническое решение |
| PDF не должен индексироваться | X-Robots-Tag: noindex |
Для noindex безопасный порядок следующий:
- Разрешить роботу обход URL.
- Вернуть
200 OKбез промежуточных редиректов. - Добавить одну непротиворечивую директиву
noindex. - Удалить URL из sitemap.
- Не создавать новые внутренние ссылки без необходимости.
- Запросить переобход при срочной задаче.
- Проверить исключение в Google и Яндексе.
Если страница уже не существует, не создавайте пустой документ только ради noindex. Используйте корректный статус удаления.
Как вернуть страницу в индекс после noindex
Важно: одного удаления тега недостаточно. Если сохранились другие ограничения, страница не вернётся в индекс. Проверьте всю цепочку:
- Страница отвечает
200 OK. - В HTML нет
noindexдля нужного робота. - В ответе нет
X-Robots-Tag: noindex. - robots.txt разрешает обход.
- canonical указывает на саму страницу или выбранную корректную версию.
- URL присутствует в sitemap.
- На страницу ведут индексируемые внутренние ссылки.
- Контент обладает самостоятельной ценностью.
После исправления запросите переобход и отслеживайте дату последнего сканирования. Если страница доступна, но не индексируется, причина может быть не в директивах, а в дублях, качестве или слабых сигналах. Используйте подробную диагностику из статьи почему страницы не индексируются.
Массовое случайное закрытие сайта
Если noindex попал в общий шаблон:
- исправьте источник директивы;
- очистите серверный и CDN-кэш;
- пересоберите статические страницы;
- проверьте выборку URL разных типов;
- обновите sitemap и
lastmodтолько для реально изменённых страниц; - отправьте приоритетные URL на переобход;
- ежедневно следите за обходом, индексом, показами и ошибками.
Не меняйте одновременно URL, canonical, контент и архитектуру без необходимости: это усложнит оценку восстановления.
Настройка noindex в CMS и JavaScript-фреймворках
Конкретный синтаксис зависит от платформы, но принцип остаётся одинаковым: директива должна присутствовать в финальном ответе для нужного URL, формироваться из одного источника и проверяться после сборки или очистки кэша.
Gatsby
В Gatsby SEO-метаданные обычно формируются через Head или общий SEO-компонент. Правило должно зависеть от данных страницы, а не от проверки URL строкой в нескольких шаблонах.
Упрощённый пример:
export const Head = ({ data, location }) => {
const page = data.markdownRemark.frontmatter
const robots = page.noindex ? 'noindex, follow' : 'index, follow'
return (
<>
<title>{page.metatitle}</title>
<meta name="robots" content={robots} />
<link
rel="canonical"
href={`https://example.com${location.pathname}`}
/>
</>
)
}Поле noindex можно хранить во frontmatter:
noindex: trueНе добавляйте это поле автоматически ко всем новым материалам. Безопаснее считать страницу индексируемой только для утверждённых публичных типов либо явно задавать правила в модели контента. Выбор зависит от редакционного процесса: главное, чтобы состояние было предсказуемым.
После gatsby build проверьте HTML в каталоге public, а затем production-URL. Локальный React DOM не доказывает, что поисковый робот получает такой же тег. Если сайт размещён за CDN, сравните исходный файл сборки и сетевой ответ.
React с клиентским рендерингом
Если приложение отдаёт одинаковую пустую оболочку, а метатеги создаются только в браузере, управление индексированием становится зависимым от рендеринга JavaScript. Для SEO-посадочных страниц предпочтительны SSR, SSG или серверная установка X-Robots-Tag.
Особенно опасен сценарий, когда исходный HTML содержит noindex, а клиент после загрузки меняет его на index. Робот может обработать первоначальное ограничение. Безопасная публикация должна сразу отдавать правильное состояние.
Next.js
В современных версиях Next.js директивы задают через Metadata API или серверно сформированный <head>. Правило должно вычисляться на сервере для конкретного маршрута. Проверьте также промежуточные ответы, preview-режим и кэш статической генерации.
Концептуальный пример метаданных:
export const metadata = {
robots: {
index: false,
follow: true,
},
}При условной генерации важно не перепутать значения index: false и окружение. Preview и staging лучше защищать паролем или сетевым доступом, а не только noindex.
WordPress
В WordPress глобальная настройка «Попросить поисковые системы не индексировать сайт» предназначена прежде всего для закрытых или тестовых установок. Если оставить её включённой после запуска, весь сайт может получить запрещающую директиву.
SEO-плагины позволяют управлять типами записей, архивами, метками и отдельными документами. После изменения:
- очистите кэш WordPress;
- очистите серверный кэш и CDN;
- откройте исходный код;
- убедитесь, что другой плагин не выводит второй robots-тег;
- проверьте XML-карту, которую генерирует активный SEO-плагин.
Не закрывайте автоматически все категории и метки. Часть таксономий может быть полноценными тематическими хабами, а часть — пустыми дублями. Решение зависит от структуры контента.
Интернет-магазины и CMS каталогов
В магазинах правила чаще привязаны к сочетанию типа страницы и параметров. Полезно разделить URL на группы:
- карточки доступных товаров;
- временно отсутствующие товары;
- удалённые товары с заменой и без неё;
- индексируемые категории;
- отобранные SEO-фильтры;
- технические фильтры и сортировки;
- внутренний поиск;
- корзина, сравнение и избранное.
Для каждой группы заранее задают код ответа, robots, canonical, наличие в sitemap и внутренние ссылки. Такое описание превращает случайный набор условий в управляемую матрицу индексации.
Nginx, Apache и CDN
Серверный X-Robots-Tag удобен для файлов и целых служебных разделов, но его легко применить слишком широкой маской. Проверяйте не только URL, который нужно закрыть, но и соседний URL, который обязан индексироваться.
Пример негативной и позитивной проверки:
curl -I https://example.com/private/report.pdf
curl -I https://example.com/public/catalog.pdfЕсли заголовок добавляет CDN, изменение приложения его не удалит. Составьте карту уровней, способных менять ответ: приложение, reverse proxy, веб-сервер, CDN, edge-функции и защитные сервисы.
Практические сценарии выбора директив
Сценарий 1. Товар временно закончился
Если товар вернётся, не ставьте noindex автоматически. Сохраните страницу, покажите статус, альтернативы и возможность уведомления. URL продолжает отвечать спросу и сохраняет накопленные сигналы.
Если товар снят навсегда, оцените замену. При точном аналоге применяют 301-редирект. Если аналогов нет, можно сохранить полезную архивную страницу, вернуть 410 или 404 — решение зависит от спроса, ссылок и пользовательской ценности.
Сценарий 2. Фильтр по популярному свойству
Запрос «красные беговые кроссовки» может иметь самостоятельный спрос. Если фильтр содержит достаточный ассортимент, уникальный заголовок, описание и стабильный URL, его можно сделать индексируемой посадочной страницей.
Комбинацию из пяти редких параметров, сортировки и вида отображения следует закрыть или не создавать как доступную роботам ссылку. Нельзя решать задачу правилом «все фильтры noindex»: сначала отделите SEO-подборки от технических комбинаций.
Сценарий 3. Страница результатов поиска
Внутренний поиск обычно закрывают через noindex, follow, убирают из sitemap и ограничивают бесконечную генерацию ссылок на запросы. Если страницы поиска создаются из пользовательского ввода, следите за спамом и нагрузкой.
Создавать SEO-страницы на основе частых поисковых запросов можно только как отдельный редакционный процесс: стабильный URL, проверенный интент, полезная подборка и уникальные элементы. Это уже не технический результат поиска, а посадочная страница.
Сценарий 4. PDF-лид-магнит
Если PDF должен привлекать трафик сам, оставьте его индексируемым и обеспечьте понятное название, ссылки и контекст. Если поисковая посадочная страница должна ранжироваться вместо файла, PDF можно закрыть через X-Robots-Tag: noindex, оставив ссылку для скачивания.
Canonical внутри PDF поддерживается не всеми рабочими цепочками одинаково, поэтому серверный заголовок и ясная архитектура обычно проще для контроля.
Сценарий 5. Страница рекламной кампании
Краткосрочный лендинг может дублировать основную услугу. До запуска определите его жизненный цикл. Возможные варианты:
- уникальная поисковая посадочная страница — индексировать;
- дубль только для рекламы —
noindex; - временная версия основной страницы — после кампании 301;
- персонализированный URL с параметрами — canonical на основной URL и отсутствие индексируемых ссылок на параметры.
Сценарий 6. Staging-копия сайта
Одного noindex недостаточно. Тестовый домен может быть обнаружен, скопирован и открыт посторонним. Защитите его авторизацией, VPN или списком разрешённых адресов. Дополнительный noindex полезен как страховка, но не как единственная защита.
Следите, чтобы конфигурация staging не переносилась в production. Переменные окружения должны влиять на доступ и метаданные предсказуемо, а релизный тест — проверять несколько публичных URL.
Сценарий 7. Архив тегов блога
Тег с десятками тематически связанных статей, описанием и удобной навигацией может быть полезным хабом. Тег с одной статьёй и пустым шаблонным текстом часто не заслуживает отдельного места в индексе.
Вместо глобального запрета установите критерии: минимальное число материалов, уникальное описание, отсутствие дубля категории и редакционная ценность. Слабые архивы можно временно закрыть, а после наполнения вернуть в индекс.
Сценарий 8. Пагинация каталога
Страницы /category/page/2/ помогают роботу находить глубокие товары. Если закрыть их noindex, поисковик всё равно может обходить ссылки, но со временем значимость закрытых документов меняется. Надёжнее дополнить пагинацию ссылками на подкатегории, популярные товары, sitemap и HTML-карту, а решение об индексировании принять после анализа.
Сценарий 9. Параметры аналитики
UTM-метки не должны создавать отдельные внутренние ссылки и попадать в sitemap. Сервер или приложение может сохранять параметры для аналитики, затем приводить пользователя к чистому URL. Если параметры остаются, self-canonical на чистый адрес помогает консолидации. Массовый noindex для каждой UTM-версии обычно не является первым решением.
Сценарий 10. Устаревшая статья
Старый материал не нужно закрывать только из-за даты. Обновите его, объедините с более сильной страницей через 301 или честно сохраните как архив, если он остаётся полезным. noindex подходит, когда страница должна быть доступна по прямой ссылке, но не должна участвовать в поиске, — это более редкая задача.
Массовый аудит и мониторинг изменений
Для сайта с тысячами URL ручная проверка исходного кода не работает. Нужна сегментация по шаблонам и сопоставление нескольких источников данных.
Шаг 1. Соберите полный набор URL
Объедините:
- URL из sitemap.xml;
- внутренние ссылки из краулера;
- страницы из Google Search Console;
- URL из Яндекс Вебмастера;
- серверные логи;
- адреса из аналитики и внешних ссылок;
- известные параметры и шаблоны CMS.
Удалите точные дубли, но сохраните параметры и варианты регистра для диагностики. Цель — увидеть не только страницы, которые владелец считает важными, но и реальные адреса, доступные поисковику.
Шаг 2. Зафиксируйте технические поля
Для каждого URL получите:
| Поле | Что показывает |
|---|---|
| Код ответа | Доступен, перенаправлен или удалён документ |
| Final URL | Куда ведёт цепочка редиректов |
| Meta robots | Директива в HTML |
| X-Robots-Tag | Директива в HTTP-заголовке |
| Robots.txt | Может ли робот получить документ |
| Canonical | Какая версия объявлена основной |
| Sitemap | Рекомендует ли сайт индексировать URL |
| Inlinks | Сколько внутренних ссылок ведёт на страницу |
| Глубина | Насколько далеко URL от главной |
| Последний обход | Видела ли система актуальные изменения |
Шаг 3. Сопоставьте желаемое и фактическое состояние
Создайте поле Target indexability: «индексировать» или «не индексировать». Его нельзя автоматически вывести только из текущего тега, иначе аудит подтвердит существующую ошибку. Желаемое состояние задаётся владельцем продукта и SEO-специалистом по роли шаблона.
После этого выделите группы:
- должны индексироваться, но имеют
noindex; - не должны индексироваться, но доступны без ограничений;
noindexи одновременно заблокированы в robots.txt;noindex, но находятся в sitemap;noindexс canonical на другой URL;- индексируемые URL с canonical на закрытую страницу;
- редиректы или ошибки с robots-директивами;
- страницы с различными правилами в HTML и HTTP.
Шаг 4. Определите источник правила
Не исправляйте тысячи URL по одному. Найдите уровень, который создаёт директиву:
- поле в CMS;
- шаблон страницы;
- общий SEO-компонент;
- серверная конфигурация;
- CDN;
- плагин;
- middleware;
- правило для окружения;
- ручной HTML редактора.
Одна ошибка в условии шаблона способна затронуть весь раздел. После исправления проверьте представителей каждой группы и граничные URL.
Шаг 5. Оцените приоритет восстановления
В первую очередь открывают страницы с органическим спросом, показами, внешними ссылками, коммерческой ценностью и важной ролью во внутренней архитектуре. Затем — категории и хабы, через которые робот обнаруживает другие документы.
Не отправляйте на переобход все URL одновременно. Начните с главной, ключевых разделов, сильных посадочных страниц и свежего sitemap. Поисковая система сама расширит обход, если архитектура и сервер работают стабильно.
Шаг 6. Мониторьте результат
До изменения зафиксируйте базовые показатели:
- число индексируемых URL по типам;
- количество исключённых тегом
noindex; - показы и клики;
- частоту обхода;
- долю запросов роботов к нужным шаблонам;
- число URL в sitemap;
- серверные ошибки;
- дату последнего сканирования приоритетных страниц.
После релиза проверяйте техническую доступность сразу, а индекс и видимость — в динамике. Рост числа индексированных URL сам по себе не является целью. Важно, чтобы в поиск вернулись нужные страницы, а технические URL остались исключёнными.
План контроля после массового снятия noindex
В день релиза: проверить код, заголовки, robots.txt, sitemap, кэш и выборку шаблонов.
Через 1–3 дня: проверить повторный обход приоритетных URL, ошибки сервера и первые изменения в панелях.
Через 1–2 недели: сравнить индексирование по группам, показы, запросы роботов и оставшиеся исключения.
Через 3–4 недели: оценить органическую видимость и качество попавших в индекс страниц. Если поисковик обходит URL, но не индексирует их без noindex, переходите к анализу качества, дублей и внутренних сигналов.
Автоматические проверки в CI
Для важных шаблонов полезны тесты, которые после сборки подтверждают:
- на публичных страницах нет
noindex; - служебные страницы содержат ожидаемую директиву;
- canonical имеет абсолютный корректный URL;
- в sitemap отсутствуют закрытые страницы;
- staging и production используют разные политики доступа;
- HTTP-заголовки не меняют правила неожиданно.
Простой тест не заменяет SEO-аудит, но защищает от наиболее дорогой ошибки — случайной публикации глобального noindex.
Кто должен согласовывать правила индексации
Для крупного проекта таблица правил должна быть общей для SEO-специалиста, разработчика, контент-команды и владельца продукта. SEO определяет поисковую роль шаблонов, продукт отвечает за пользовательские сценарии, разработчик реализует условия, а контент-команда не меняет директивы без понятного процесса.
Храните для каждого типа страницы ожидаемый код ответа, robots-директиву, canonical, наличие в sitemap и условия перехода между состояниями. Например, карточка товара может быть активной, временно недоступной, архивной или удалённой. Для каждого состояния заранее задаётся техническое поведение. Такая матрица уменьшает число срочных исправлений и делает миграции безопаснее.
Пересматривайте правила после изменений каталога, CMS, рендеринга или структуры URL. То, что было корректно для небольшого сайта, может перестать работать после появления фасетной навигации, региональных версий и пользовательского контента.
Типичные ошибки при использовании noindex
Директива осталась после разработки
Тестовую среду закрывают от индексации, затем шаблон переносят в production вместе с noindex. Предотвращение: автоматическая проверка собранного HTML и блокировка релиза при обнаружении директивы на приоритетных шаблонах.
Noindex добавляется только JavaScript
Директива, появляющаяся после сложного клиентского сценария, менее надёжна и труднее проверяется. Для Gatsby, React и других фреймворков отдавайте корректный тег в исходном HTML или серверном заголовке.
Robots.txt не даёт увидеть noindex
Сначала разрешите обход и дождитесь обработки. Нельзя требовать от робота выполнить инструкцию внутри документа, который запрещено получать.
URL остаётся в sitemap
Карта продолжает рекомендовать закрытый адрес. Исправляйте генератор sitemap, а не удаляйте строки вручную после каждой сборки.
Конфликт нескольких тегов
Один компонент выводит index, другой — noindex. Поисковые системы склонны учитывать ограничивающую директиву. У страницы должен быть единый владелец SEO-метаданных.
Неправильный шаблон или маска
Правило для /filter/ случайно применяется к категории, а HTTP-заголовок для PDF — ко всему разделу. Перед публикацией проверяйте позитивную и негативную выборки URL.
Noindex используют вместо canonical
Дубли закрываются, но их сигналы не консолидируются. Выбирайте инструмент по цели: canonical — предпочтительная версия, noindex — исключение, редирект — перенос.
Считают noindex защитой данных
Страница остаётся публичной. Закрытая информация требует контроля доступа независимо от поисковых директив.
Закрывают пагинацию и теряют обнаружение URL
Если товары доступны только через закрытые страницы пагинации, робот получает слабый путь к глубоким карточкам. Нужна продуманная структура категорий и внутренних ссылок.
Не проверяют HTTP-заголовки
В HTML всё выглядит правильно, но CDN или сервер добавляет X-Robots-Tag: noindex. Всегда проверяйте полный ответ.
Чек-лист безопасной настройки noindex
- Определена причина исключения страницы из поиска.
- Выбран правильный инструмент: noindex, canonical, редирект, 404/410 или авторизация.
- URL доступен поисковому роботу.
- Сервер возвращает ожидаемый код ответа.
- В HTML присутствует только одна согласованная директива.
- Проверен
X-Robots-Tag. - Нет конфликта с robots.txt.
- Canonical соответствует выбранной стратегии.
- Закрытый URL удалён из sitemap.xml.
- Проверена мобильная и десктопная версия.
- Проверен исходный HTML, а не только DOM.
- Очищен CDN- и серверный кэш.
- Сделан массовый обход затронутого шаблона.
- Приоритетные URL проверены в Google Search Console.
- URL проверены в Яндекс Вебмастере.
- После изменения отслеживаются обход и индексирование.
Часто задаваемые вопросы
Чем noindex отличается от robots.txt?
noindex запрещает включать документ в индекс, но для чтения директивы робот должен получить страницу. robots.txt управляет обходом и может помешать роботу увидеть noindex.
Можно ли использовать noindex вместе с follow?
Да. noindex, follow — стандартный вариант для доступной страницы, которая не должна показываться в поиске, но содержит полезные ссылки.
Удалит ли noindex страницу сразу?
Нет. Поисковая система должна повторно обойти URL и обработать директиву. Для срочного скрытия дополнительно используют временное удаление в панели вебмастера.
Нужно ли закрывать noindex-страницу в robots.txt?
До удаления из индекса — нет, иначе робот может не увидеть директиву. После исключения решение зависит от масштаба раздела и стратегии обхода.
Должна ли страница с noindex находиться в sitemap.xml?
Нет. В sitemap включают канонические индексируемые URL. Сочетание sitemap и noindex создаёт противоречивые сигналы.
Что лучше для дубля: noindex или canonical?
Если нужно объединить сигналы похожих страниц, обычно выбирают canonical. Если дубль больше не нужен и есть точная замена — 301. noindex используют, когда документ должен оставаться доступным, но не участвовать в поиске.
Можно ли закрыть PDF от индексации?
Да, через HTTP-заголовок X-Robots-Tag: noindex. После настройки проверьте фактический ответ сервера или CDN.
Почему страница всё ещё показывается после установки noindex?
Чаще всего робот ещё не переобошёл URL, обход запрещён в robots.txt, директива добавляется только после выполнения JavaScript или кэш отдаёт старую версию.
Почему страница не возвращается после удаления noindex?
Проверьте HTTP-заголовок, robots.txt, canonical, код ответа, sitemap, внутренние ссылки и качество документа. Удаление одного тега не гарантирует индексацию.
Можно ли закрыть только часть текста?
Для управления индексацией страницы используйте поддерживаемые директивы целого документа. Не рассчитывайте на фрагментарное скрытие как на универсальный SEO-инструмент.
Влияет ли noindex на краулинговый бюджет?
Закрытые страницы всё равно периодически обходятся. Для крупного числа технических URL нужно устранять причины их генерации и управлять архитектурой, а не только ставить noindex.
Вывод
Главный вывод:
noindex— инструмент исключения доступной страницы из поиска. Он не заменяет robots.txt, canonical, редиректы, корректные коды ответа и защиту данных. Все технические сигналы должны быть однозначными.
Для единичного URL достаточно проверить HTML, заголовки и панели вебмастеров. Для шаблона или крупного сайта нужен массовый аудит, контроль релиза и мониторинг после изменения. Если сомневаетесь между noindex, canonical и редиректом, сначала сформулируйте желаемый конечный результат для пользователя и поиска — после этого правильный технический инструмент становится очевиднее.
Если требуется найти причину массового исключения страниц, закажите технический SEO-аудит: проверим директивы, шаблоны, карту сайта, canonical, внутреннюю архитектуру и фактическое поведение поисковых роботов.

