Duplicitní obsah
Také známé jako: duplicitní stránky, duplicate content, duplicita obsahu
Duplicitní obsah je stejný nebo velmi podobný text dostupný na více adresách, ať už v rámci jednoho webu, nebo napříč weby. Vyhledávač musí vybrat jednu verzi k indexaci a zbytek potlačí, takže se hodnota obsahu tříští místo aby se sčítala.
Kdy duplicitní obsah v e-shopu řešit
Ve chvíli, kdy se do indexu dostávají adresy, které tam nemají co dělat, nebo když ti Search Console hlásí stránky jako „duplicitní, Google zvolil jiný kanonický prvek". Druhý spouštěč je, když ti kategorie padá ve výsledcích a nad ní se zobrazuje její vlastní filtrovaná varianta.
Interní duplicita vzniká skoro vždy technicky — z parametrických URL, facetové navigace, stránkování a z produktů zařazených do více kategorií. Externí duplicita vzniká převzetím dodavatelských popisů.
Jak to vypadá v praxi
Jeden produkt bývá dostupný jako /boty/tenisky/model-x i /novinky/model-x, k tomu s parametrem ?variant=42 a ?utm_source=heureka. To jsou čtyři adresy s jedním obsahem. Bez zásahu vyhledávač zaindexuje kteroukoli z nich a interní odkazy si mezi ně rozdělí váhu.
Naproti tomu popis produktu opsaný z webu dodavatele je duplicitou vůči několika desítkám dalších e-shopů. Vyhledávač takový text nezakáže, jen nemá důvod upřednostnit zrovna tebe — a rozhodne se podle jiných signálů, ve kterých malý e-shop obvykle prohrává.
Nejčastější chyby
- Snaha vyřešit všechno canonicalem. Canonical patří na varianty téhož obsahu, ne na stránky, které mají zaniknout (tam patří 301) ani na ty, které nemají do indexu vůbec (tam noindex).
- Blokace duplicit v robots.txt. Zakázaná stránka se nestáhne, takže se z ní nepřečte ani canonical. Duplicita zůstane v indexu jako prázdný záznam.
- Přepsání jen prvních pár produktů. Unikátní popis u deseti bestsellerů duplicitu katalogu neřeší; smysl dává jít po kategoriích, které reálně mají hledanost.
- Ignorování stránkování. Druhá a další strana kategorie mívá stejný titulek a popisek jako první — pro vyhledávač tři skoro identické stránky.
Shoptet a Upgates
Časté otázky
Penalizuje Google duplicitní obsah?
Ne, samotná duplicita není důvod k penalizaci. Vyhledávač jen vybere jednu verzi k zobrazení. Penalizace hrozí až u záměrného škálovaného kopírování cizího obsahu.
Musím přepsat popisy všech produktů od dodavatele?
Nemusíš a u velkého katalogu to ani nedává ekonomický smysl. Vyplatí se jít po kategoriích a produktech, které mají reálnou hledanost, a u zbytku spolehnout na ostatní signály.
Je duplicitou i stejný text v české a slovenské verzi e-shopu?
Technicky ano, ale řeší se to jinak — přes hreflang, který vyhledávači řekne, že jde o jazykové a regionální varianty téhož obsahu.
Související pojmy
- Canonical URL – Canonical URL je odkaz v hlavičce stránky, kterým web vyhledávačům oznamuje, která adresa je hlavní verze obsahu. Používá se všude tam, kde je stejný nebo velmi podobný obsah dostupný pod více URL — v e-shopu typicky při filtrování, řazení a stránkování kategorií.
- Parametrické URL – Parametrická URL je adresa s dotazovací částí za otazníkem, která upravuje, co se na stránce zobrazí, nebo nese informaci pro měření. V e-shopu vzniká při filtrování, řazení, stránkování a označování kampaní — a je nejběžnějším zdrojem adres, které se množí bez nového obsahu.
- Facetová navigace – Facetová navigace je filtrování produktů podle vlastností — velikosti, barvy, značky, ceny. Pro zákazníka je to nejrychlejší cesta k produktu, pro vyhledávač zdroj obrovského množství adres s téměř stejným obsahem, protože každá kombinace filtrů může vytvořit vlastní URL.
- Paginace – Paginace je rozdělení dlouhého výpisu produktů nebo článků na číslované strany. Pro vyhledávač je to řetěz stránek s podobným obsahem a rozdílnými produkty — a způsob, jakým se řeší, rozhoduje o tom, jestli se produkty z dalších stran vůbec dostanou do indexu.
- Hreflang – Hreflang je značka, kterou web vyhledávači sděluje, že určitá stránka má jazykové nebo regionální varianty, a která z nich patří které skupině uživatelů. Používá se u vícejazyčných e-shopů a u variant pro různé země, i když je jazyk stejný.
Další pojmy ze skupiny SEO & AEO
- Canonical URLCanonical URL je odkaz v hlavičce stránky, kterým web vyhledávačům oznamuje, která adresa je hlavní verze obsahu. Používá se všude tam, kde je stejný nebo velmi podobný obsah dostupný pod více URL — v e-shopu typicky při filtrování, řazení a stránkování kategorií.
- Crawl budgetCrawl budget je množství stránek, které robot vyhledávače na daném webu za určitý čas stáhne. Určuje ho jednak technická kapacita serveru, jednak to, jak hodnotný web pro vyhledávač je — a u velkých e-shopů rozhoduje, jak rychle se změny v katalogu promítnou do výsledků.
- Facetová navigaceFacetová navigace je filtrování produktů podle vlastností — velikosti, barvy, značky, ceny. Pro zákazníka je to nejrychlejší cesta k produktu, pro vyhledávač zdroj obrovského množství adres s téměř stejným obsahem, protože každá kombinace filtrů může vytvořit vlastní URL.
- HreflangHreflang je značka, kterou web vyhledávači sděluje, že určitá stránka má jazykové nebo regionální varianty, a která z nich patří které skupině uživatelů. Používá se u vícejazyčných e-shopů a u variant pro různé země, i když je jazyk stejný.
- IndexaceIndexace je zařazení stránky do databáze vyhledávače, ze které se pak sestavují výsledky hledání. Stránka, která není v indexu, se ve výsledcích nemůže objevit — a to i tehdy, když je běžně dostupná a robot ji už navštívil.
- JavaScript SEOJavaScript SEO je zajištění toho, aby obsah generovaný na straně prohlížeče byl dostupný i vyhledávačům a AI asistentům. Zásadní je, že obsah, který v HTML není a doplní ho až JavaScript, část robotů nikdy neuvidí.