Конфликт noindex и meta refresh: Google учитывает директиву из исходного кода
Ключевые факты
- 1 Google учитывает noindex из исходного HTML, даже если он отсутствует в отрендеренной версии.
- 2 Конфликт meta refresh редиректа и noindex приводит к непредсказуемому поведению индексации.
- 3 Джон Мюллер подтвердил отсутствие строгого порядка обработки этих директив.
- 4 GSC 'Проверка URL' может маскировать проблему, показывая финальный URL без noindex.
- 5 Решения включают использование 301 редиректа или удаление noindex из исходного кода.
Проблема возникает, когда на одной странице одновременно присутствуют мета-тег robots noindex и meta refresh редирект. Инструмент 'Проверка URL' в Google Search Console (GSC) может показывать чистую страницу без noindex, так как он анализирует финальный URL после редиректа. Однако Google сканирует исходный HTML до рендера, и если noindex находится там, он может быть обработан первым. Джон Мюллер из Google подтвердил, что комбинация meta refresh редиректа с noindex работает непредсказуемо, так как нет строгого порядка приоритетов обработки этих директив. Это означает, что noindex, присутствующий в исходном коде, может быть учтен, даже если страница после рендера перенаправляется на URL, где noindex отсутствует. В результате страница выпадает из выдачи, а передача веса через canonical, который также может быть в исходнике, не срабатывает. Для решения проблемы предлагаются следующие варианты: отключить авторедирект на корневом домене, использовать серверный HTTP-редирект 301 для передачи веса, или удалить noindex из исходного HTML. В случае ограничений CMS, можно рассмотреть отключение мультиязычной функции для возврата главной страницы на корневой URL с последующим 301 редиректом с /en/.