Як вирішити проблеми з канонікалізацією сторінок

Щоб дізнатися, яку сторінку алгоритми Google вважають канонічною, скористайтеся інструментом перевірки URL. Навіть якщо ви явно вкажете канонічну URL-адресу, Google може вибрати іншу сторінку. Це залежить від багатьох факторів, наприклад від якості контенту. Перш ніж приступити до усунення несправностей, перевірте, чи не є сторінка, обрана Google, більш привабливою для користувачів, які бачать ваш сайт у результатах пошуку.

Є кілька причин, чому вказаний Google варіант відрізняється від канонічної URL-адреси, яку ви хочете бачити в результатах пошуку. Нижче перераховані найпоширеніші проблеми.

Поширені проблеми з нормалізацією сторінок

Мовні варіанти сайту без локалізованих анотацій

Якщо на кількох ваших сайтах розміщено майже однаковий контент різними мовами, дотримуйтесь наших рекомендацій щодо локалізованих версій сторінок. Наприклад, якщо існують різні версії вашого сайту з однаковим контентом для англомовних користувачів із США, Великобританії та Австралії, то додайте для сайту анотації hreflang. Це допоможе користувачам з різних регіонів бачити в результатах Пошуку саме ті сторінки, які для них призначені.

Помилки в канонічних елементах

Деякі системи управління контентом (CMS) або їх плагіни можуть неправильно виконувати нормалізацію, вказуючи на небажані URL-адреси. Щоб дізнатися, чи це так, перевірте свій HTML за допомогою інструментів розробника в браузері. Неправильне використання елементів або переадресація rel="canonical" чи 3xx може призвести до непередбаченої зміни канонічного URL вашого сайту. Якщо ви помітили подібну помилку, зверніться до свого постачальника CMS.

Помилки в налаштуваннях серверів

Вибір основної URL-адреси поза вашим доменом може бути пов’язаний з помилками в налаштуваннях серверів, на яких розміщений контент. Наприклад:

  • Некоректно налаштований сервер може повертати контент із сайту example.com у відповідь на запит URL із сайту other.example.
  • Два не пов’язані між собою сервери можуть видавати однакові сторінки помилок soft 404, які не розпізнаються Google як повідомлення про помилки. Якщо ви вважаєте, що проблема полягає саме в цьому, зв’яжіться зі своїм хостинг-провайдером.

Атаки зловмисників

Деякі види хакерських атак полягають у додаванні на сайт коду, який виконує переадресацію 3xx HTTP або вставляє міждоменну анотацію link з атрибутом rel="canonical" в HTML-елемент <head> або HTTP-заголовок. У результаті користувач потрапляє на сайт, який містить шкідливе ПЗ або спам. У таких випадках замість справжнього URL зламаного сайту алгоритми Google можуть вибрати URL, вказаний зловмисником.

Скопійований контент

Елемент link з канонічним URL не рекомендується використовувати тим, хто хоче запобігти дублюванню свого контенту партнерами з розповсюдження, оскільки сторінки часто сильно відрізняються. Найефективніше рішення — попросити партнерів заблокувати індексацію вашого контенту. Більш детальна інформація наведена в статті Як уникнути дублювання статей в Google News. У ній також представлені рекомендації щодо блокування контенту, скопійованого з Google Search.

Підроблений сайт

У рідкісних випадках алгоритми Google можуть вибрати URL зовнішньої сторінки, на якій без дозволу розміщені копії ваших матеріалів. Якщо ваші матеріали були опубліковані на іншому сайті з порушенням авторських прав, зверніться до власника сервера цього сайту з проханням видалити їх. Ви також можете попросити Google видалити сторінку з вкраденими матеріалами з результатів пошуку у зв’язку з порушенням Закону США «Про авторське право в цифрову епоху» (DMCA).

Зверніть увагу, що якщо канонічна URL-адреса відноситься до ресурсу Search Console, який вам не належить, то ви не зможете відстежувати трафік на сторінці-копії.