Stat.vin — сервіс перевірки та купівлі автомобілів з аукціонів Copart та IAAI (США й Канада). Для кожного лота сайт формує окрему сторінку з історією продажів, ціною, пошкодженнями, пробігом та іншими даними за VIN. Сайт працює кількома мовними версіями й має мільйони URL.
На старті проєкту:
Задача полягала в тому, щоб встановити причину втрати індексації, відновити обхід сайту Googlebot і повернути в індекс максимально можливу кількість сторінок. Додатково треба було підготувати сайт до запуску нового напряму: сторінок купівлі й доставки автомобілів зі США.
Замість масової відправки URL на переіндексацію ми розібрали весь ланцюжок:
Discovery → Crawling → Rendering → Indexing → Internal Linking → Site Structure → Monitoring
Першим кроком перевірили, чи Google отримує URL, які Stat.vin відправляє на індексацію. Оскільки серверного логування не було, клієнт налаштував збір даних про ботів через Cloudflare.
За crawl logs аналізували:
Це дало змогу замінити припущення аналізом фактичної поведінки Googlebot.
Одна з перших гіпотез — некоректна робота стороннього сервісу примусової індексації. Для перевірки провели експеримент: відправили в сервіс 100 тестових URL (orphan pages) і перевірили Cloudflare crawl logs.
Результат: Googlebot відвідав 83 зі 100 URL (~83%).
Механізм доставки URL до Googlebot працював. Причину слід було шукати в crawl budget, структурі сайту, пріоритетності URL і сигналах, які сайт передавав Google.
1) Rendering. Критичних проблем, які заважали б Google отримувати основний контент сторінок, не виявили.
2) Duplicate content. Великий блок How to Buy a Vehicle повторювався на багатьох сторінках автомобілів. Рекомендували унікалізувати його шаблонним/spin-контентом або закрити від індексації. Згодом підготували ТЗ на генерацію унікалізованого контенту на основі даних автомобіля: make, model, year, VIN, mileage, auction, damage, sale status тощо.
3) Duplicate URLs. Для одного автомобіля/лота могло генеруватися кілька URL. Частина з них мала canonical, але все одно:
Рекомендували обмежити обхід таких посилань.
4) Duplicate meta tags. Повторювалися Title та Description. Підготували шаблони метатегів для кожного типу сторінок і мовних версій.
Перевірили роботу Last-Modified, If-Modified-Since та HTTP 304 Not Modified.
На основній частині Stat.vin механізм працював коректно. У розділі Auto.RIA некоректно працювали заголовки Last-Modified і відповідь сервера 304 Not Modified.
Метою було допомогти Google визначати, які сторінки дійсно змінилися й потребують повторного завантаження, а на які не варто витрачати crawl budget.
За bot logs сформувалася гіпотеза: Google активно обходить sitemap актуальних автомобілів і значно рідше — sitemap проданих. При цьому сайт передавав величезну кількість URL з різною SEO-цінністю.
Змінили принцип: не «відправити максимум сторінок», а «пріоритизувати URL з найвищою цінністю та ймовірністю індексації».
Для sitemap проданих автомобілів запропонували залишати переважно:
Додатково:
Окремий пріоритет отримали автомобілі, для яких щойно з’явився повний VIN і сформувалася повноцінна сторінка Stat.vin.
Логіка: що раніше Google отримає нову VIN-сторінку Stat.vin порівняно з іншими сайтами, то вища ймовірність, що її буде сприйнято як першоджерело, а не черговий дубль даних.
Цю логіку впровадили в роботу стороннього індексатора: на індексацію автоматично відправляються автомобілі, повністю додані в базу напередодні, з VIN і доступною сторінкою.
Провели аналіз внутрішньої перелінковки та підготували рекомендації. Задачею цих дій було дати Googlebot додаткові шляхи виявлення сторінок і перерозподілити внутрішню вагу на користь важливих розділів і сторінок автомобілів.
Дані аукціонів зберігали одну марку в різних варіантах: Mercedes Benz, Mercedes, Mercedes-Benz. Для моделей варіантів було ще більше. У базі накопичилися тисячі варіантів марок і моделей, що потенційно створювало велику кількість слабких і дубльованих сторінок.
Клієнт розробив систему щоденної нормалізації марок і моделей. Після релізу:
Для сайту з мільйонами URL навіть незначне погіршення server response time може суттєво впливати на кількість сторінок, які Googlebot здатен обійти. Тому швидкість відповіді сервера контролювали протягом усього проєкту.
У вересні в Google Search Console зафіксували: зростання часу відповіді сервера → зниження кількості crawl requests.
Передали проблему клієнту. Команда розробки повернула відкладене завантаження та внесла зміни для прискорення сайту. Після впровадження клієнт відзначив покращення трафіку.
Паралельно з відновленням індексації працювали з посилальним профілем:
Аналіз і очищення профілю від нового спаму виконувалися регулярно.
Після технічних змін регулярно відстежували:
У липні в автомобільній тематиці був період високої волатильності Google, на тлі якого тимчасово знизилися crawling і органічний трафік. Тому зміни оцінювали після стабілізації видачі, а не за кілька днів.
Кількість сторінок в індексі Google:
За період роботи кількість проіндексованих сторінок зросла на 5,7 млн (+72%). Ріст у липні відбувся попри тимчасове значне скорочення crawl budget. На останньому зафіксованому етапі кількість сторінок в індексі продовжувала зростати.
Відновлення індексації не дало одномоментного лінійного росту всього органічного трафіку: на показники впливали зміни у видачі, коливання попиту та періоди волатильності. Після зниження в червні–липні динаміка в серпні стала позитивною.
Органічні кліки за даними Google Search Console:
Покази за той самий період (липень → серпень): 7,22 млн → 6,02 млн.
У серпні кліки зросли на 4,1% відносно липня, CTR — з 6,05% до 7,55%. Сайт отримав більше кліків за меншої кількості показів.
На VIN-сторінках автомобілів — одному з ключових типів сторінок проєкту — за внутрішніми звітами зростали і кліки, і CTR.
Після стабілізації технічної частини почали розширювати семантичну структуру сайту. Провели дослідження попиту на купівлю та доставку автомобілів зі США й підготували:
У перший період після запуску нові сторінки доставки почали отримувати органічні кліки й з’являтися близько до ТОПу за цільовими запитами.
Стартова ситуація: ≈15 млн сторінок випало з індексу, органічний трафік знизився приблизно на 40%.
Результат:
Проєкт перейшов від відновлення втраченої індексації до розширення органічної видимості за комерційними напрямами.
Для сайтів з мільйонами сторінок недостатньо масово відправляти URL на переіндексацію. Luxeo аналізує фактичну поведінку Googlebot, визначає пріоритетні URL і налаштовує структуру, sitemap та технічні сигнали з урахуванням crawl budget.
Якщо у вас масово випали сторінки з індексу, залиште заявку, і ми проаналізуємо індексацію вашого сайту й запропонуємо план відновлення.
Контакти
Заявка на просування: order@luxeo.team
Для партнерства: partner@luxeo.com.ua
Дякуємо за заявку!
Наші спеціалісти зв'яжуться з вами протягом 24 годин