Přeskočit na obsah

Robots.txt

Také známé jako: soubor robots.txt, robots

Robots.txt je textový soubor v kořeni domény, kterým web říká robotům, které části webu nemají procházet. Řídí stahování, nikoli indexaci — a je to veřejně čitelný pokyn, který slušné roboty respektují a ostatní ignorují.

Kdy robots.txt řešit

Při spuštění webu, po migraci a vždy, když se v indexu objeví adresy, které tam nemají být. Nejčastější reálná potřeba u e-shopu je omezit procházení kombinací filtrů, interního vyhledávání a košíku, aby crawl budget šel na produkty a kategorie.

Druhý moment, který je nový, je rozhodnutí o AI crawlerech — jestli chceš, aby tvůj obsah používaly modely a odpovědní vyhledávače. To se řeší právě tady.

Jak vypadá funkční robots.txt

Soubor leží vždy na https://domena.cz/robots.txt, nikde jinde. Obsahuje bloky pravidel pro jednotlivé roboty a odkaz na sitemapu:

User-agent: * Disallow: /kosik/ Disallow: /vyhledavani/ Sitemap: https://domena.cz/sitemap.xml

Zákaz platí na prefix cesty, takže Disallow: /kosik/ pokryje i všechno pod ním. Odkaz na sitemapu musí být absolutní adresa.

Nejčastější chyby

  • Použití robots.txt k odstranění stránky z indexu. Robot k ní nesmí, takže si nemůže přečíst noindex — a stránka v indexu zůstane bez popisku.
  • Zablokování CSS a JavaScriptu. Vyhledávač pak stránku nevyrenderuje správně a může ji vyhodnotit jako rozbitou nebo nepoužitelnou na mobilu.
  • Zapomenutý Disallow: / z vývoje. Po spuštění zablokuje celý web. Patří to na začátek každého povypouštěcího checklistu.
  • Blokace adres, které jsou v sitemapě. Protichůdný signál — jednou robota zveš, podruhé ho vyhazuješ.

Shoptet a Upgates

Časté otázky

Odstraní robots.txt stránku z výsledků hledání?

Ne. Zablokovaná stránka se může ve výsledcích objevit bez popisku. Na odstranění slouží noindex, ke kterému ale musí mít robot přístup.

Jak zakážu AI crawlerům používat můj obsah?

Pravidly pro konkrétní user-agenty, například GPTBot, ClaudeBot, PerplexityBot nebo Google-Extended. Respektování je dobrovolné — roboti, kteří se pravidly neřídí, je ignorují.

Kam patří robots.txt na subdoméně?

Každá subdoména má vlastní robots.txt ve svém kořeni. Soubor na hlavní doméně pro subdoménu neplatí.

Další pojmy ze skupiny SEO & AEO

Ondřej RuhsamE-commerce trendy ze světa, připravené pro Shoptet a Upgates. Konkrétní nastavení, limity a postupy z reálných projektů.

Aktualizováno

Novinky do e-mailu

Po vydání nové případové studie vám přijde 
odkaz.

Odběrem souhlasíte se zpracováním osobních údajů.