Canonical URL
Také známé jako: rel=canonical, kanonická URL, canonical tag, kanonizace
Canonical URL je odkaz v hlavičce stránky, kterým web vyhledávačům oznamuje, která adresa je hlavní verze obsahu. Používá se všude tam, kde je stejný nebo velmi podobný obsah dostupný pod více URL — v e-shopu typicky při filtrování, řazení a stránkování kategorií.
Kdy canonical v e-shopu řešit
Vždy, když je jeden obsah dostupný pod více adresami. Na e-shopu to nastává mnohem častěji, než se čeká: filtrování a řazení v kategorii, stránkování, UTM parametry z kampaní, produkt zařazený do dvou kategorií, varianty s vlastní URL, tisková verze, http i https, verze s www i bez.
Bez canonical si vyhledávač vybere hlavní verzi sám. Někdy vybere dobře. Když vybere špatně, indexuje ti adresu s filtrem místo čisté kategorie a odkazová síla se rozdrobí mezi adresy, které spolu soutěží.
Jak správně nastavený canonical vypadá
Do <head> stránky patří jeden řádek s absolutní adresou hlavní verze:
<link rel="canonical" href="https://example.cz/damska-obuv">
Kategorie /damska-obuv je dostupná i jako /damska-obuv?sort=cena-asc a /damska-obuv?barva=cerna. Všechny tři varianty nesou stejný canonical na čistou adresu kategorie, takže se indexuje jedna stránka.
Pozor na to, že canonical musí ukazovat na adresu, která opravdu existuje, vrací stav 200 a není zakázaná v robots.txt. Odkaz na přesměrovávanou nebo neexistující stránku signál celý zneplatní.
Nejčastější chyby
- Canonical míří na jinou stránku, než jakou uživatel vidí. Vyhledávač pak převezme titulek a popisek cílové adresy a metadata aktuální stránky zahodí.
- Canonical na homepage ze všech stránek webu. Klasický důsledek špatně nastavené šablony — vede k hromadnému vypadnutí obsahu z indexu.
- Kanonizace stránkování na první stranu. Produkty ze druhé a další strany se pak nikdy nedostanou do indexu. Správně má být na stránkování self-referencing canonical.
- Relativní adresa nebo nekonzistentní tvar (jednou s www, jednou bez, jednou s lomítkem na konci). Vždy jeden absolutní tvar.
Canonical, noindex, nebo 301 — co kdy použít
Tři nástroje na tři různé situace, a zaměňují se nejčastěji ze všech technických SEO prvků.
- Canonical — obsah má existovat a být dostupný, ale indexovat se má jiná verze. Typicky filtrace a řazení.
- noindex — stránka má být dostupná uživateli, ale nemá být v indexu vůbec. Typicky výsledky interního vyhledávání nebo košík.
- 301 přesměrování — stará adresa má zaniknout a všichni mají skončit na nové. Typicky při migraci e-shopu.
Kombinace canonical a noindex na jedné stránce je protimluv: říkáš vyhledávači „indexuj tuhle jinou adresu" a zároveň „tuhle stránku neindexuj". Signály se ruší.
Shoptet a Upgates
Časté otázky
Má mít canonical i stránka, která žádnou duplicitu nemá?
Ano. Stránka by měla odkazovat sama na sebe. Bez self-referencing canonical se snadno stane, že se do indexu dostane verze s parametrem z kampaně místo čisté adresy.
Zaindexuje vyhledávač stránku, i když canonical ukazuje jinam?
Může. Canonical je silný signál, ale ne závazný příkaz. Pokud si ho ostatní signály — interní odkazy, sitemap, přesměrování — protiřečí, vyhledávač si vybere sám.
Řeší canonical stránkování kategorií?
Neřeší, a kanonizace všech stran na první je chyba. Každá strana stránkování má mít vlastní self-referencing canonical, jinak produkty z dalších stran vypadnou z indexu.
Související pojmy
- Duplicitní obsah – Duplicitní obsah je stejný nebo velmi podobný text dostupný na více adresách, ať už v rámci jednoho webu, nebo napříč weby. Vyhledávač musí vybrat jednu verzi k indexaci a zbytek potlačí, takže se hodnota obsahu tříští místo aby se sčítala.
- Parametrické URL – Parametrická URL je adresa s dotazovací částí za otazníkem, která upravuje, co se na stránce zobrazí, nebo nese informaci pro měření. V e-shopu vzniká při filtrování, řazení, stránkování a označování kampaní — a je nejběžnějším zdrojem adres, které se množí bez nového obsahu.
- Facetová navigace – Facetová navigace je filtrování produktů podle vlastností — velikosti, barvy, značky, ceny. Pro zákazníka je to nejrychlejší cesta k produktu, pro vyhledávač zdroj obrovského množství adres s téměř stejným obsahem, protože každá kombinace filtrů může vytvořit vlastní URL.
- Paginace – Paginace je rozdělení dlouhého výpisu produktů nebo článků na číslované strany. Pro vyhledávač je to řetěz stránek s podobným obsahem a rozdílnými produkty — a způsob, jakým se řeší, rozhoduje o tom, jestli se produkty z dalších stran vůbec dostanou do indexu.
- Meta robots (noindex, nofollow) – Meta robots je značka v hlavičce stránky, kterou web říká vyhledávači, jestli má stránku zařadit do indexu a jestli má následovat odkazy na ní. Na rozdíl od robots.txt se týká konkrétní stránky a robot ji musí načíst, aby se pokyn dozvěděl.
- Indexace – Indexace je zařazení stránky do databáze vyhledávače, ze které se pak sestavují výsledky hledání. Stránka, která není v indexu, se ve výsledcích nemůže objevit — a to i tehdy, když je běžně dostupná a robot ji už navštívil.
Další pojmy ze skupiny SEO & AEO
- Crawl budgetCrawl budget je množství stránek, které robot vyhledávače na daném webu za určitý čas stáhne. Určuje ho jednak technická kapacita serveru, jednak to, jak hodnotný web pro vyhledávač je — a u velkých e-shopů rozhoduje, jak rychle se změny v katalogu promítnou do výsledků.
- Duplicitní obsahDuplicitní obsah je stejný nebo velmi podobný text dostupný na více adresách, ať už v rámci jednoho webu, nebo napříč weby. Vyhledávač musí vybrat jednu verzi k indexaci a zbytek potlačí, takže se hodnota obsahu tříští místo aby se sčítala.
- Facetová navigaceFacetová navigace je filtrování produktů podle vlastností — velikosti, barvy, značky, ceny. Pro zákazníka je to nejrychlejší cesta k produktu, pro vyhledávač zdroj obrovského množství adres s téměř stejným obsahem, protože každá kombinace filtrů může vytvořit vlastní URL.
- HreflangHreflang je značka, kterou web vyhledávači sděluje, že určitá stránka má jazykové nebo regionální varianty, a která z nich patří které skupině uživatelů. Používá se u vícejazyčných e-shopů a u variant pro různé země, i když je jazyk stejný.
- IndexaceIndexace je zařazení stránky do databáze vyhledávače, ze které se pak sestavují výsledky hledání. Stránka, která není v indexu, se ve výsledcích nemůže objevit — a to i tehdy, když je běžně dostupná a robot ji už navštívil.
- JavaScript SEOJavaScript SEO je zajištění toho, aby obsah generovaný na straně prohlížeče byl dostupný i vyhledávačům a AI asistentům. Zásadní je, že obsah, který v HTML není a doplní ho až JavaScript, část robotů nikdy neuvidí.