Duplicate content
Stejný obsah na více URL – negativní pro SEO
Co je duplicate content
Duplicate content je stejný nebo velmi podobný obsah dostupný na více URL téhož webu nebo napříč weby. Nemusí jít o kopírování od konkurence, nejčastěji si duplicity web vyrobí sám na sobě a majitel o nich vůbec neví.
Postih nečekejte, horší je tichá ztráta
Google za duplicitní obsah běžně netrestá, chová se prakticky: z několika verzí si jednu vybere, tu zařadí do výsledků a zbytek nechá být. Potíž je v tom, že vybírá on, ne vy. Když má e-shop stejný produkt na pěti adresách, rozdělí se mezi ně odkazy i signály z chování uživatelů a žádná není tak silná, jak by mohla být jedna jediná. K tomu se pálí crawl budget na stránky, které nikdy nikomu nic nepřinesou.
Kde duplicity vznikají
- filtry a řazení v e-shopu, které ke stejnému výpisu přilepí parametr do URL
- produktové popisky převzaté od dodavatele, se kterými jede stejně dalších dvacet e-shopů v Česku
- web běžící současně s www i bez www, po http i po https
- stránkování, tisková verze, adresy s UTM parametry z kampaní
Co s tím
Nejčastější nástroj je canonical tag: na duplicitní verzi jím řeknete, která adresa je ta hlavní. U variant, které nemají existovat vůbec, jako je verze s www vedle verze bez ní, patří místo canonicalu přesměrování 301. A u převzatých popisků pomůže jediná věc, totiž napsat vlastní. Aspoň u produktů, které vám vydělávají.
Duplicity hledám hned na začátku auditu, protože je to práce s rychlou návratností. Projedu web crawlerem, seřadím stránky podle shody titulků a popisků a většinou do půl hodiny vidím, kde se síla webu tříští. U e-shopů na Shoptetu to bývají filtry, u WordPressů archivy štítků a autorů, na které za celou dobu nikdo neklikl. Příbuzný, ale jiný problém je kanibalizace klíčových slov, kdy si na jeden dotaz konkurují dvě vlastní stránky s odlišným obsahem.