Sitemap (XML)
Mapa webu pro vyhledávače v XML formátu
Co je sitemap.xml
Sitemap.xml je XML soubor se seznamem adres, které chce web nechat projít a zaindexovat vyhledávači. Vedle samotné adresy u každé položky bývá datum poslední změny; hodnoty priority a frekvence aktualizace dnes vyhledávače ignorují, takže se s nimi netrapte.
Komu se vyplatí
Velkým webům a těm, kde se robot k části obsahu těžko dokliká. Čerstvá doména bez zpětných odkazů, archiv článků schovaný za stránkováním, e-shop s hlubokou strukturou kategorií a tisícovkami variant. U dvacetistránkové prezentace s pořádnou navigací sitemapa nic nezachrání ani nepokazí, robot si tam poradí i bez ní.
Co do sitemapy nepatří
Jen adresy, které mají skončit v indexu. Vypadnout musí stránky s noindexem, přesměrování, chybové adresy i duplicity odkázané kanonickým odkazem jinam. Search Console tyhle rozpory vypisuje jako problémy a má pravdu: pokud jednou rukou adresu nabízíte a druhou vyhazujete, robot z toho vytěží leda zmatek. Hotový soubor odevzdáte v Search Console, případně na něj stačí odkaz v robots.txt.
Sitemapa tohohle webu
Tenhle web má sitemapu se všemi adresami včetně každého hesla ve slovníku a spravuju ji ručně, protože běží na statickém HTML bez redakčního systému. Zní to jako práce navíc, jenže má to výhodu: nová stránka se do sitemapy dostane až ve chvíli, kdy jsem si jistý, že je hotová a patří tam. Na WordPressu nebo Shoptetu tuhle starost odvede plugin či samotná platforma a moje role se scvrkne na kontrolu, jestli do souboru nepadají i adresy, které v indexu nechci.