🌟 Что делать со страницами, которые не попали в индекс
В отчётах Search Console часто появляются статусы «Не проиндексировано», и здесь важно правильно интерпретировать причины. Разберём основные кейсы:
Crawled / Discovered, currently not indexed
Чаще всего это слабый контент. Причины: thin-страницы, низкий спрос, плохая перелинковка.
Что делать:
➡️Удалить «мёртвый» контент (проверив внутренние и внешние ссылки).
➡️Работать с параметрическими дублями: использовать rel=canonical или редиректы, а не только robots.txt. Файл robots.txt блокирует краулинг, но не очищает уже известные URL из индекса.
➡️Следить, чтобы все важные страницы отдавали HTTP 200 и имели ссылки внутри сайта.
Duplicate without user-selected canonical
Google считает страницу дубликатом без явного каноникла.
Что делать:
➡️Установить корректный rel=canonical.
➡️Убирать дублирующий контент и наводить порядок в URL-структуре.
Blocked due to other 4xx issue
Google пытался попасть на страницу, но получил ошибку 4xx.
Что делать:
➡️Проверить конкретные коды ошибок и убедиться, что блокировка обоснована.
Быстрые решения:
➡️404 Not Found — убрать внутренние ссылки на такие страницы. Если на них есть внешние ссылки — настроить 301 редирект на максимально релевантный URL.
➡️Soft 404 — Google видит страницу как “not found”, хотя ответ 200. Нужно либо улучшить контент (чтобы страница выглядела полноценной), либо вернуть правильный код 404/410.
📎 Регулярный аудит таких статусов в GSC помогает поддерживать чистый индекс, концентрировать краулинговый бюджет на ценных страницах и не терять ссылочный вес.
Post #196
254

- ❤ 4
- 👍 2
- 🔥 2