Noindex
Instrukce, aby stránka nebyla indexována
Co je noindex
Noindex je pokyn, kterým web říká vyhledávači, aby stránku nezařazoval do indexu. Zapisuje se meta tagem robots v hlavičce HTML, u souborů typu PDF hlavičkou X-Robots-Tag na straně serveru. Stránka zůstává běžně dostupná návštěvníkům, jen zmizí z výsledků vyhledávání.
Kam noindex patří
Na stránky, které mají existovat, ale ve vyhledávání nemají co dělat: děkovací stránka po odeslání objednávky, výsledky vnitřního vyhledávání, tiskové verze článků, testovací nebo klientská verze webu. Nic z toho nikdo nehledá a v indexu to jenom ředí obraz webu.
Jak stránku opravdu dostat z výsledků
Na jedné věci se to celé láme: stránku musíte nechat procházet. Robot si značku noindex přečte jedině tak, že stránku stáhne a podívá se do jejího kódu. Když jí souběžně zakážete procházení v robots.txt, dovnitř se nedostane, pokyn nikdy neuvidí a adresa může ve výsledcích viset dál.
Pořadí kroků je tedy jasné. Přidat noindex, ponechat volný přístup, počkat, až robot přijde a stránku z indexu vyřadí. Až potom má smysl přemýšlet o zákazu procházení, a upřímně, ve většině případů k tomu není důvod. Pár stránek s noindexem robota nezruinuje.
Noindex zapomenutý po nasazení
Nejdražší chybu s noindexem potkávám pořád na stejném místě. Na vývojové verzi webu se indexace zablokuje, aby se testovací stránky neobjevily ve vyhledávání, a při nasazení na ostro to nikdo nesmaže. Web pak týdny mizí z výsledků a nikdo neví proč. Po každém větším nasazení proto projedu zdrojový kód domovské stránky a několika šablon, jestli tam nezůstal robots noindex. Pět minut práce, které umí ušetřit hodně nepříjemných telefonátů.