Canonical tag
HTML tag říkající, která URL je „pravá“ (zabraňuje duplicitám)
Co je canonical tag
Canonical tag je HTML značka <link rel="canonical"> v hlavičce stránky, kterou vyhledávači říkáte, která URL adresa je hlavní verzí obsahu, když je ten stejný obsah dostupný na víc adresách.
Odkud se ty adresy berou
- Filtry a řazení v e-shopu, kde kategorie vygeneruje desítky adres.
- UTM parametry z newsletteru a z bannerů.
- Produkt zařazený do dvou kategorií, tedy dvě cesty a dvě adresy.
- Web dostupný s www i bez, s lomítkem na konci i bez něj.
Bez canonicalu si Google vybere sám a nemusí trefit tu, kterou ve výsledcích chcete mít. Navíc se síla odkazů rozdrobí mezi adresy, které jsou fakticky jedna stránka. Tomu se říká duplicitní obsah.
Doporučení, ne příkaz
Canonical je signál. Google ho váží spolu s přesměrováním, se sitemapou a s interními odkazy, a když mu to nesedí, kanonizuje si stránku po svém. V Search Console to pak čtete jako „Duplicita, Google zvolil jinou stránku, než jste určili vy“. Většinou je za tím rozpor: canonical míří jinam, než kam vedou vlastní odkazy webu.
Čím si to pokazíte
Kanonická adresa musí být indexovatelná. Kanonizovat na stránku s noindex je protimluv, ze kterého si vyhledávač nevybere. Stejně dopadne canonical mířící na 404 nebo na adresu, která se přesměrovává jinam. A pozor na šablony, kde se generuje z aktuální adresy včetně parametrů: každá varianta pak ukazuje sama na sebe a tag je k ničemu.
Filtry jsou obchodní rozhodnutí
Canonical kontroluju v technickém auditu mezi prvními, protože chyba v šabloně se propíše do tisíců adres naráz. Nejvíc práce s ním bývá na e-shopech s filtry. Tam se rozhoduje, co má být samostatná stránka pro vyhledávání (typicky filtr, který lidi opravdu hledají) a co jen varianta kanonizovaná na kategorii. To rozhodnutí nedělám bez klienta, je obchodní, ne technické.