Что такое noindex?
Noindex — это директива для поисковых систем, которая запрещает добавлять конкретную страницу в поисковый индекс. Передаётся она мета-тегом robots в коде страницы или HTTP-заголовком X-Robots-Tag, при этом сама страница остаётся доступной для посетителей и может получать ссылки.
Если перевести на человеческий: noindex — это табличка «в каталог не вносить» на странице, которая сама никуда не исчезает. Бизнесу директива нужна, чтобы из поиска выпадали служебные, дублирующие и просто слабые адреса — фильтры, пагинация, личные кабинеты, тестовые версии, — и при этом не мешали продающим страницам собирать трафик.
Как работает noindex
Загружая документ, поисковый робот читает его код и HTTP-заголовки ответа. Обнаружив директиву, он помечает адрес как запрещённый к индексации: страница остаётся сканируемой, но в индекс не попадает и в результатах поиска не показывается.
Ключевой нюанс: noindex запрещает не сканирование, а индексацию. Робот обязан сначала зайти на страницу, чтобы вообще увидеть директиву. Поэтому запрет в robots.txt и noindex — плохая пара: если URL закрыт для обхода, робот не загрузит документ, не прочитает команду и вполне может проиндексировать адрес «вслепую» по внешним ссылкам.
Директиву можно выдавать всем роботам сразу (noindex) или конкретному — например, отдельно для Яндекса или Google. Встречается и комбинация noindex, follow: страницу не индексировать, но ссылки с неё обходить и учитывать.
Мета-тег robots или X-Robots-Tag: что выбрать
Способов передать директиву два — отсюда и путаница в названиях: под «тегом Noindex» могут иметь в виду и метатег, и HTTP-заголовок.
- Мета-тег robots — строка вида meta name="robots" content="noindex" в секции head HTML-документа. Годится для страниц, шаблон которых вы контролируете. Тег должен быть в исходном коде сразу, а не подставляться скриптом после загрузки, — иначе робот его не увидит.
- X-Robots-Tag — HTTP-заголовок ответа сервера. Это единственный вариант для не-HTML файлов: PDF-прайсов, картинок, документов, — а ещё удобный способ адресовать запрет отдельным роботам.
По силе действия директивы равнозначны, дублировать их без нужды не стоит. Нюанс 2026 года: современная поисковая система — это не только классическая выдача, и страницы под noindex не попадают также в нейроответы и ИИ-сводки. Директива фактически выключает документ из всех поисковых поверхностей сразу.
Главное правило: страница должна быть доступна краулеру
Самая частая причина, по которой директива не срабатывает, — недоступность документа. Если адрес закрыт в robots.txt, отдаёт 404, 500 или бесконечно редиректит, робот директиву не увидит. Отсюда порядок работ: сначала снимаем запрет на сканирование и убеждаемся, что сервер отвечает кодом 200, затем добавляем noindex.
Отдельно про сроки: директива начинает работать только после того, как робот снова обойдёт URL. До этого момента страница может ещё днями показываться в результатах со старым тегом title и влиять на показы по запросам кластера. Проверять результат стоит в Яндекс Вебмастере и Search Console, а не «на глаз».
Типичные ошибки
- Путают с disallow. Правило в robots.txt запрещает обход, noindex — индексацию. Чтобы страница ушла из выдачи, нужен именно noindex: закрытый robots.txt сам по себе задачу не решает.
- Noindex на весь сайт. После правки общего шаблона директива легко попадает в head всех страниц, и сайт целиком исчезает из поиска. Спасает регулярная проверка исходного кода ключевых шаблонов.
- Закрывают лишнее. Фильтры, пагинация, страницы сравнения — законные кандидаты. Случайный noindex на карточке товара или статье блога отрезает органический трафик, который потом возвращают месяцами.
- Смешивают с canonical. Если канонический адрес ведёт на другую версию, а на странице стоит noindex, сигналы противоречат друг другу. Оставляйте что-то одно.
Коротко о главном
Noindex — точечный инструмент гигиены индекса, а не способ «починить» слабую страницу. Перед включением убедитесь, что документ доступен краулеру и отвечает кодом 200, а после — отследите выпадение из индекса в панелях вебмастера. В 2026 году директива выключает страницу и из классической выдачи, и из ответов ИИ-поиска, поэтому ставить её стоит осознанно.