Canonical, noindex i duplikaty treści
W skrócie
Canonical mówi „to jest preferowany URL tej treści”. Noindex mówi „nie pokazuj tego URL-a w wynikach”. To nie są zamienniki. robots.txt Disallow nie usuwa strony z indeksu. Najczęstszy błąd: dwa tagi canonical (dwie wtyczki SEO) albo canonical wskazujący na HTTP, gdy strona jest na HTTPS.
Google chce jeden dokument na jedną intencję. Duplikaty powstają z www/non-www, HTTP/HTTPS, UTM, paginacji, sortowania i filtrów. Twoim zadaniem jest albo złączyć je kanonicznym, albo wyjąć z indeksu (noindex), albo nie dawać do crawla (Disallow) - i nie pomylić tych trzech. robots.txt steruje crawlem, nie indeksem.
Kiedy canonical, kiedy noindex
| Sytuacja | Narzędzie | Dlaczego |
|---|---|---|
| Ta sama treść pod dwoma URL-ami (www, trailing slash) | 301 + canonical na docelowy | Jedna wersja na zawsze |
| Filtrowany listing z cienką treścią | noindex, follow (albo parametry w GSC) | Nie chcemy rankingów na „czerwony, rozmiar M” |
| Koszyk, thank-you, wyszukiwarka wewnętrzna | noindex | Nie ma wartości w SERP |
| Strona, której nie chcemy w Google, ale ma linki | noindex, bez Disallow | Robot musi zobaczyć noindex |
| API, admin, feedy | Disallow w robots.txt | Oszczędność crawla, nie „ukrycie” |
Dwa zestawy canonical - klasyk WordPressa
Yoast + RankMath, albo motyw + wtyczka, emitują dwa <link rel="canonical">. Google może zignorować oba. W audycie SEO WordPress to punkt „jedna wtyczka SEO”. Audyto zgłasza strony z wieloma canonical i wieloma JSON-LD.
Sklepy: facety, UTM, HTTP
- Canonical zawsze do HTTPS i hosta, który jest w Search Console.
- UTM nie powinny tworzyć indeksowalnych kopii - canonical do czystego URL albo 301.
- Magento layered navigation: często tysiące URL-i. Trzeba strategii (noindex filtrów albo canonical do kategorii) - zobacz też wydajność Magento, bo crawl budget zżera te same facety.
Jak naprawić duplikaty krok po kroku
- 1Wybierz jedną wersję hosta i protokołu; resztę przekieruj 301.
- 2W źródle HTML zostaw dokładnie jeden rel=canonical na URL kanoniczny.
- 3Wyłącz drugą wtyczkę SEO / duplikat z motywu.
- 4Na stronach bez wartości w SERP ustaw meta robots noindex i nie blokuj ich w robots.txt.
- 5W Search Console sprawdź „duplikat bez kanonicznego wybranego przez użytkownika”.
- 6Po zmianach poproś o indeksację kluczowych URL-i i obserwuj pokrycie.
hreflang i paginacja - krótko
Wersje językowe to nie duplikat, jeśli każda ma własny hreflang i self-canonical. Paginacja: albo rel next/prev historycznie, albo noindex na stronie 2+ gdy treść jest cienka, albo infinite scroll z jednym kanonicznym listingiem. Nie łącz hreflang wskazującego na URL, który sam ma noindex - to sprzeczny sygnał, podobny do canonical na stronę 404. To fundament audytu strony WWW. Zrób darmowy audyt - jeśli masz dwa canonical, zobaczysz to w raporcie.
Najczęstsze pytania
Czym różni się canonical od noindex?
Canonical wskazuje preferowany URL przy podobnej treści (strona może zostać w indeksie jako duplikat skonsolidowany). Noindex prosi, by tego URL-a nie pokazywać w wynikach. Do usunięcia z indeksu służy noindex, nie canonical w drugą stronę.
Czy canonical to przekierowanie?
Nie. Użytkownik zostaje na bieżącym URL. To wskazówka dla wyszukiwarki. Siła leży w 301, gdy wersje mają być na stałe jedną.
Czy robots.txt usuwa duplikat z Google?
Nie. Disallow blokuje crawlowanie. URL może zostać w indeksie bez opisu. Szczegóły w poradniku robots.txt.
Co zrobić z parametrami UTM?
Nie indeksuj ich. Canonical do wersji bez parametrów albo nie linkuj wewnętrznie z UTM. Kampanie zostaw w analityce, nie w sitemap.
Czy każdy URL musi mieć canonical?
Tak - nawet self-canonical (wskazanie na siebie). To zmniejsza ryzyko, że parametry albo www „rozjadą” indeks.
Dlaczego Google wybrał inny kanoniczny niż ja?
Bo sygnały (301, sitemap, linki wewnętrzne, treść) sprzeczne z Twoim tagiem. Wyrównaj je: jedna wersja w sitemap, w menu i w canonical.
Sprawdź swoją stronę w 60 sekund
Wydajność, SEO, dostępność i bezpieczeństwo w jednym raporcie. Pierwszy audyt za darmo.
Zrób darmowy audyt