2 min czytania

Canonical, noindex i duplikaty treści

W skrócie

Canonical mówi „to jest preferowany URL tej treści”. Noindex mówi „nie pokazuj tego URL-a w wynikach”. To nie są zamienniki. robots.txt Disallow nie usuwa strony z indeksu. Najczęstszy błąd: dwa tagi canonical (dwie wtyczki SEO) albo canonical wskazujący na HTTP, gdy strona jest na HTTPS.

Google chce jeden dokument na jedną intencję. Duplikaty powstają z www/non-www, HTTP/HTTPS, UTM, paginacji, sortowania i filtrów. Twoim zadaniem jest albo złączyć je kanonicznym, albo wyjąć z indeksu (noindex), albo nie dawać do crawla (Disallow) - i nie pomylić tych trzech. robots.txt steruje crawlem, nie indeksem.

Kiedy canonical, kiedy noindex

SytuacjaNarzędzieDlaczego
Ta sama treść pod dwoma URL-ami (www, trailing slash)301 + canonical na docelowyJedna wersja na zawsze
Filtrowany listing z cienką treściąnoindex, follow (albo parametry w GSC)Nie chcemy rankingów na „czerwony, rozmiar M”
Koszyk, thank-you, wyszukiwarka wewnętrznanoindexNie ma wartości w SERP
Strona, której nie chcemy w Google, ale ma linkinoindex, bez DisallowRobot musi zobaczyć noindex
API, admin, feedyDisallow w robots.txtOszczędność crawla, nie „ukrycie”

Dwa zestawy canonical - klasyk WordPressa

Yoast + RankMath, albo motyw + wtyczka, emitują dwa <link rel="canonical">. Google może zignorować oba. W audycie SEO WordPress to punkt „jedna wtyczka SEO”. Audyto zgłasza strony z wieloma canonical i wieloma JSON-LD.

Sklepy: facety, UTM, HTTP

  • Canonical zawsze do HTTPS i hosta, który jest w Search Console.
  • UTM nie powinny tworzyć indeksowalnych kopii - canonical do czystego URL albo 301.
  • Magento layered navigation: często tysiące URL-i. Trzeba strategii (noindex filtrów albo canonical do kategorii) - zobacz też wydajność Magento, bo crawl budget zżera te same facety.

Jak naprawić duplikaty krok po kroku

  1. 1Wybierz jedną wersję hosta i protokołu; resztę przekieruj 301.
  2. 2W źródle HTML zostaw dokładnie jeden rel=canonical na URL kanoniczny.
  3. 3Wyłącz drugą wtyczkę SEO / duplikat z motywu.
  4. 4Na stronach bez wartości w SERP ustaw meta robots noindex i nie blokuj ich w robots.txt.
  5. 5W Search Console sprawdź „duplikat bez kanonicznego wybranego przez użytkownika”.
  6. 6Po zmianach poproś o indeksację kluczowych URL-i i obserwuj pokrycie.

hreflang i paginacja - krótko

Wersje językowe to nie duplikat, jeśli każda ma własny hreflang i self-canonical. Paginacja: albo rel next/prev historycznie, albo noindex na stronie 2+ gdy treść jest cienka, albo infinite scroll z jednym kanonicznym listingiem. Nie łącz hreflang wskazującego na URL, który sam ma noindex - to sprzeczny sygnał, podobny do canonical na stronę 404. To fundament audytu strony WWW. Zrób darmowy audyt - jeśli masz dwa canonical, zobaczysz to w raporcie.

Najczęstsze pytania

Czym różni się canonical od noindex?

Canonical wskazuje preferowany URL przy podobnej treści (strona może zostać w indeksie jako duplikat skonsolidowany). Noindex prosi, by tego URL-a nie pokazywać w wynikach. Do usunięcia z indeksu służy noindex, nie canonical w drugą stronę.

Czy canonical to przekierowanie?

Nie. Użytkownik zostaje na bieżącym URL. To wskazówka dla wyszukiwarki. Siła leży w 301, gdy wersje mają być na stałe jedną.

Czy robots.txt usuwa duplikat z Google?

Nie. Disallow blokuje crawlowanie. URL może zostać w indeksie bez opisu. Szczegóły w poradniku robots.txt.

Co zrobić z parametrami UTM?

Nie indeksuj ich. Canonical do wersji bez parametrów albo nie linkuj wewnętrznie z UTM. Kampanie zostaw w analityce, nie w sitemap.

Czy każdy URL musi mieć canonical?

Tak - nawet self-canonical (wskazanie na siebie). To zmniejsza ryzyko, że parametry albo www „rozjadą” indeks.

Dlaczego Google wybrał inny kanoniczny niż ja?

Bo sygnały (301, sitemap, linki wewnętrzne, treść) sprzeczne z Twoim tagiem. Wyrównaj je: jedna wersja w sitemap, w menu i w canonical.

Sprawdź swoją stronę w 60 sekund

Wydajność, SEO, dostępność i bezpieczeństwo w jednym raporcie. Pierwszy audyt za darmo.

Zrób darmowy audyt

Czytaj dalej