Skupina pojmů
SEO & AEO
Klasické SEO a novější AEO (Answer Engine Optimization) – jak být vidět ve vyhledávačích i v odpovědích AI asistentů.
- Canonical URLCanonical URL je odkaz v hlavičce stránky, kterým web vyhledávačům oznamuje, která adresa je hlavní verze obsahu. Používá se všude tam, kde je stejný nebo velmi podobný obsah dostupný pod více URL — v e-shopu typicky při filtrování, řazení a stránkování kategorií.
- Crawl budgetCrawl budget je množství stránek, které robot vyhledávače na daném webu za určitý čas stáhne. Určuje ho jednak technická kapacita serveru, jednak to, jak hodnotný web pro vyhledávač je — a u velkých e-shopů rozhoduje, jak rychle se změny v katalogu promítnou do výsledků.
- Duplicitní obsahDuplicitní obsah je stejný nebo velmi podobný text dostupný na více adresách, ať už v rámci jednoho webu, nebo napříč weby. Vyhledávač musí vybrat jednu verzi k indexaci a zbytek potlačí, takže se hodnota obsahu tříští místo aby se sčítala.
- Facetová navigaceFacetová navigace je filtrování produktů podle vlastností — velikosti, barvy, značky, ceny. Pro zákazníka je to nejrychlejší cesta k produktu, pro vyhledávač zdroj obrovského množství adres s téměř stejným obsahem, protože každá kombinace filtrů může vytvořit vlastní URL.
- HreflangHreflang je značka, kterou web vyhledávači sděluje, že určitá stránka má jazykové nebo regionální varianty, a která z nich patří které skupině uživatelů. Používá se u vícejazyčných e-shopů a u variant pro různé země, i když je jazyk stejný.
- IndexaceIndexace je zařazení stránky do databáze vyhledávače, ze které se pak sestavují výsledky hledání. Stránka, která není v indexu, se ve výsledcích nemůže objevit — a to i tehdy, když je běžně dostupná a robot ji už navštívil.
- JavaScript SEOJavaScript SEO je zajištění toho, aby obsah generovaný na straně prohlížeče byl dostupný i vyhledávačům a AI asistentům. Zásadní je, že obsah, který v HTML není a doplní ho až JavaScript, část robotů nikdy neuvidí.
- Meta robots (noindex, nofollow)Meta robots je značka v hlavičce stránky, kterou web říká vyhledávači, jestli má stránku zařadit do indexu a jestli má následovat odkazy na ní. Na rozdíl od robots.txt se týká konkrétní stránky a robot ji musí načíst, aby se pokyn dozvěděl.
- PaginacePaginace je rozdělení dlouhého výpisu produktů nebo článků na číslované strany. Pro vyhledávač je to řetěz stránek s podobným obsahem a rozdílnými produkty — a způsob, jakým se řeší, rozhoduje o tom, jestli se produkty z dalších stran vůbec dostanou do indexu.
- Parametrické URLParametrická URL je adresa s dotazovací částí za otazníkem, která upravuje, co se na stránce zobrazí, nebo nese informaci pro měření. V e-shopu vzniká při filtrování, řazení, stránkování a označování kampaní — a je nejběžnějším zdrojem adres, které se množí bez nového obsahu.
- Robots.txtRobots.txt je textový soubor v kořeni domény, kterým web říká robotům, které části webu nemají procházet. Řídí stahování, nikoli indexaci — a je to veřejně čitelný pokyn, který slušné roboty respektují a ostatní ignorují.
- Sitemap.xmlSitemap.xml je strojově čitelný seznam adres, které má vyhledávač na webu znát. Pomáhá mu obsah objevit rychleji, hlavně u velkých webů a u stránek, na které nevede dost interních odkazů — zařazení do indexu ale negarantuje.
- Strukturovaná dataStrukturovaná data jsou strojově čitelný popis toho, co je na stránce, zapsaný ve standardizovaném slovníku. Vyhledávači i AI asistentovi umožňují pochopit, že určité číslo je cena, určitý text jméno autora a určitá stránka produkt — místo aby to musely odhadovat z textu.