Facetová navigace
Také známé jako: filtrace v kategorii, faceted navigation, filtry produktů
Facetová navigace je filtrování produktů podle vlastností — velikosti, barvy, značky, ceny. Pro zákazníka je to nejrychlejší cesta k produktu, pro vyhledávač zdroj obrovského množství adres s téměř stejným obsahem, protože každá kombinace filtrů může vytvořit vlastní URL.
Kdy facetovou navigaci řešit
Ve chvíli, kdy máš víc než pár filtrů a katalog v řádu tisíců produktů. Signál, že je pozdě, je nález ve stylu „v indexu je desetkrát víc adres, než mám produktů" nebo crawl budget spotřebovaný na kombinacích filtrů.
Jak se rozhoduje, co pustit do indexu
Vodítkem je hledanost, ne technika. „Dámské zimní boty černé" je fráze, kterou lidé hledají — má smysl z ní udělat plnohodnotnou vstupní stránku s vlastním titulkem, popiskem a textem. „Dámské boty velikost 38 + modré + skladem + řazeno podle ceny" nikdo nehledá a do indexu nepatří.
Prakticky to znamená rozdělit filtry na dvě skupiny. Ta menší, hodnotná, dostane čisté adresy a vlastní obsah. Zbytek zůstane pro zákazníka plně funkční, ale pro vyhledávač neviditelný — přes canonical na základní kategorii, případně tak, že se odkazy na kombinace vůbec negenerují jako procházitelné.
Nejčastější chyby
- Nechat všechno tak, jak to platforma vygeneruje. Vede ke zaplavení indexu adresami bez hodnoty a k soutěži filtrovaných variant s vlastní kategorií.
- Zablokovat filtry v robots.txt až poté, co jsou v indexu. Zůstanou tam jako záznamy bez obsahu, protože robot k nim už nesmí přijít a přečíst si noindex.
- Udělat z hodnotné kombinace jen filtrovanou URL bez vlastního obsahu. Stránka pak nemá důvod se umístit — vypadá jako tenký obsah.
- Řešit to jen technicky, bez analýzy hledanosti. Rozhodnutí, které kombinace mají existovat, je obsahové rozhodnutí.
Shoptet a Upgates
Časté otázky
Mám filtry zakázat v robots.txt?
Až jako poslední krok a nikdy na adresy, které už v indexu jsou. Nejdřív je potřeba je z indexu dostat pomocí noindexu a teprve pak zvážit omezení procházení.
Kolik filtrovaných kombinací má být v indexu?
Jen ty, které mají doloženou hledanost — obvykle jednotky až desítky na kategorii, ne stovky. A každá z nich potřebuje vlastní titulek, popisek a text.
Zhorší omezení filtrů zákaznický zážitek?
Nemělo by. Řeší se viditelnost pro vyhledávač, ne funkčnost filtru. Zákazník filtruje dál stejně.
Související pojmy
- Parametrické URL – Parametrická URL je adresa s dotazovací částí za otazníkem, která upravuje, co se na stránce zobrazí, nebo nese informaci pro měření. V e-shopu vzniká při filtrování, řazení, stránkování a označování kampaní — a je nejběžnějším zdrojem adres, které se množí bez nového obsahu.
- Canonical URL – Canonical URL je odkaz v hlavičce stránky, kterým web vyhledávačům oznamuje, která adresa je hlavní verze obsahu. Používá se všude tam, kde je stejný nebo velmi podobný obsah dostupný pod více URL — v e-shopu typicky při filtrování, řazení a stránkování kategorií.
- Crawl budget – Crawl budget je množství stránek, které robot vyhledávače na daném webu za určitý čas stáhne. Určuje ho jednak technická kapacita serveru, jednak to, jak hodnotný web pro vyhledávač je — a u velkých e-shopů rozhoduje, jak rychle se změny v katalogu promítnou do výsledků.
- Duplicitní obsah – Duplicitní obsah je stejný nebo velmi podobný text dostupný na více adresách, ať už v rámci jednoho webu, nebo napříč weby. Vyhledávač musí vybrat jednu verzi k indexaci a zbytek potlačí, takže se hodnota obsahu tříští místo aby se sčítala.
Další pojmy ze skupiny SEO & AEO
- Canonical URLCanonical URL je odkaz v hlavičce stránky, kterým web vyhledávačům oznamuje, která adresa je hlavní verze obsahu. Používá se všude tam, kde je stejný nebo velmi podobný obsah dostupný pod více URL — v e-shopu typicky při filtrování, řazení a stránkování kategorií.
- Crawl budgetCrawl budget je množství stránek, které robot vyhledávače na daném webu za určitý čas stáhne. Určuje ho jednak technická kapacita serveru, jednak to, jak hodnotný web pro vyhledávač je — a u velkých e-shopů rozhoduje, jak rychle se změny v katalogu promítnou do výsledků.
- Duplicitní obsahDuplicitní obsah je stejný nebo velmi podobný text dostupný na více adresách, ať už v rámci jednoho webu, nebo napříč weby. Vyhledávač musí vybrat jednu verzi k indexaci a zbytek potlačí, takže se hodnota obsahu tříští místo aby se sčítala.
- HreflangHreflang je značka, kterou web vyhledávači sděluje, že určitá stránka má jazykové nebo regionální varianty, a která z nich patří které skupině uživatelů. Používá se u vícejazyčných e-shopů a u variant pro různé země, i když je jazyk stejný.
- IndexaceIndexace je zařazení stránky do databáze vyhledávače, ze které se pak sestavují výsledky hledání. Stránka, která není v indexu, se ve výsledcích nemůže objevit — a to i tehdy, když je běžně dostupná a robot ji už navštívil.
- JavaScript SEOJavaScript SEO je zajištění toho, aby obsah generovaný na straně prohlížeče byl dostupný i vyhledávačům a AI asistentům. Zásadní je, že obsah, který v HTML není a doplní ho až JavaScript, část robotů nikdy neuvidí.