Краулери Google не парсять JSON
Ілліс написав у Bluesky, що краулери Google просто завантажують файли. Парсинг відбувається далі, вже на етапі індексації. Питання виникло в контексті спільної інфраструктури, яку Google використовує в різних сервісах, включно з Merchant Center.
Звучить як дрібниця, але це пояснює кілька речей, на які регулярно натикаються при роботі з розміткою.
🔹 Краул і обробка це різні етапи. Бот забрав файл. Коли саме індексатор його розбере, окреме питання. Тому свіжий візит Googlebot у логах нічого не каже про те, чи врахована оновлена розмітка.
🔹 Логи показують тільки завантаження. 200 на сторінці і на JSON-фіді означає, що файл віддався. Далі йде черга на обробку, і на неї ти не впливаєш.
🔹 JSON-LD через JavaScript додає ще один крок. Якщо розмітка вставляється скриптом, а не лежить у вихідному HTML, до індексатора вона потрапляє після рендерингу. Це третій етап і ще одна затримка. У вихідному коді розмітки немає, у Rich Results Test вона є, у GSC її досі немає, і всі три стани одночасно правдиві.
🔹 Merchant Center працює по тій самій логіці. Фід скачали, обробили пізніше. Оновив ціни, а в товарці старі — дивись на статус обробки фіда, не на факт завантаження.
⚠️ Як перевіряти:
🔹 Rich Results Test показує, що Google бачить при живому запиті з рендерингом. Це стан «зараз».
🔹 URL Inspection у GSC показує проіндексовану версію. Порівняння живого тесту з проіндексованим і є та сама різниця між краулом і обробкою.
🔹 Звіти по структурованих даних у GSC оновлюються з лагом. Побачив помилку після правки, спочатку перевір дату останньої обробки, потім паникуй.
Post #174
276

- ❤ 2
- 👍 2
- 👌 2