Штамповка страниц не качает тематический авторитет.
Каждая лишняя страница задирает стоимость извлечения для Google и плодит микро-каннибализацию.
Почти идентичные документы размазывают
PageRank, историю кликов, релевантность запросу и сигналы GBP по страницам, которые дерутся за один интент.Тест
Query Deserves a Page (QDP) — аналог алгоритма Query Deserves Freshness Амита Сингхала — решает, заслуживает ли вариация вроде "Nylon Glock Holster" отдельной страницы или ложится блоком внутри "Glock Holster".Вариация получает свой урл, только если пробивает четыре порога:
— Высокий поисковый спрос
— Разные сущности
— Низкая схожесть запросов
— Повторяющийся паттерн запроса
Схожесть запросов — это не просто совпадение строк.
Алгоритм взвешивает важность сущностей и поисковый спрос:
BERT считает "Nike" тяжелее, чем "running" или "shoes".Поэтому ключ "
Los Angeles Car Accident Attorney" нельзя разобрать, не понимая фактический вес "Los Angeles".Если самый тяжелый термин повторяется во всех вариациях, метрика низкой схожести падает — и эти вариации схлопываются в один документ.
Данные подтверждают: удаление мусора дает рост.
Агрегатор клиник с 4 000 000 непроиндексированных почти дублей снес лишние страницы — и вытащил 600 000 дополнительных кликов при неизменных показах.
Мельбурнский сайт юристов по травмам склеил ~19 почти идентичных урлов [услуга]+[локация], собрав 232 новых ключа и подкинув 60 позиций.
Вычистка дублей под конкретные запросы в нише аренды яхт дала 248% рост кликов, 37% рост показов и плюс 29% к средней позиции.
Целься в самую важную пару "услуга-локация" прямо с главной — в страницу с максимальным
PageRank и плотным краулингом — и усиливай точным или частичным вхождением ключа в домене или названии сайта.Google оценивает качество ресурса по исходящим с главной внутренним ссылкам; прокидывай линки на самые сильные "узлы качества" напрямую оттуда.
Дальше сверяйся с четырьмя
KPI краулинга: процент обхода HTML не ниже 99%; сумма 200 и 304 статусов от 99%; процент обнаружения выше 20%; 100% обходов HTML направляется только на индексируемые урлы с кодом 200, зашитые в sitemap и перелинковку.GSC раскрывает лишь около 30% реальных данных — за остальным лезь в сырые логи.Ценность страницы работает как гейт для тяжелых алгоритмов.
Согласно антимонопольным показаниям Панду Наяка, Google не гоняет дорогие системы вроде
RankBrain на мусорных документах — они получают только базовую проверку тематики и локальности.Быстрый сбор успешных кликов форсирует запуск этих тяжелых алгоритмов.
https://searchengineland.com/how-semantics-and-topical-authority-improve-local-seo-482980
#Cannibalization #CrawlBudget #Crawling
@MikeBlazerX
⚠️ Закрытый канал: @MikeBlazerPRO