Už máte sitemap, odeslali jste ji Googlu, a web se začíná indexovat. Ale jednoho dne zjistíte, že se na Googlu objevuje i administrační stránka, interní platební stránka nebo stagingová stránka vašeho webu. Když zákazník zadá název vaší společnosti – zobrazí se mu dokonce i nedokončená testovací stránka.
Nebo naopak: publikujete nový blogový příspěvek, čekáte dva týdny a stále se neobjevuje na Googlu. Zeptáte se technického oddělení a oni řeknou: „Soubor robots.txt blokuje Google před procházením celého webu.“
Oba scénáře souvisejí s malým souborem, kterému mnoho webových správců nevěnuje pozornost: robots.txt.
Tento článek vysvětlí, co je robots.txt, jak funguje, kdy ho potřebujete upravit a jakým běžným chybám by se podniky měly vyhnout – vše jednoduchým jazykem s praktickými příklady.
Co je robots.txt? Vysvětlení pro správce webu
Pokud sitemap je plánek budovy – říká Googlu, jaké místnosti existují, pak robots.txt je cedule „Omezený přístup“ – říká Googlu, do kterých místností nemá vstupovat.
Technicky řečeno: robots.txt je malý textový soubor, který se nachází v kořenovém adresáři webu (např.: https://example.com/robots.txt). Tento soubor obsahuje pravidla, která říkají botům vyhledávačů – jako je Googlebot – co:
- Stránky, které smí procházet (crawl)
- Stránky, které nesmí procházet
- Kde se nachází sitemap
Robots.txt libovolného webu si můžete prohlédnout zadáním: nazev-domeny.com/robots.txt do prohlížeče.
💡 Důležité: robots.txt je pouze zdvořilý požadavek, nikoli absolutní příkaz. Důvěryhodné boty jako Googlebot se budou řídit, ale zlí boti (spam, scrapers) ho mohou ignorovat. Pokud potřebujete skutečné zabezpečení, použijte heslo nebo firewall – nespoléhejte na robots.txt.
Jak vypadá soubor robots.txt?
Tento soubor nemusíte psát od začátku. Ale abyste pochopili, co vidíte, zde je jednoduchý soubor robots.txt:
User-agent: *
Disallow: /admin/
Disallow: /thanh-toan/
Disallow: /staging/
Allow: /
Sitemap: https://example.com/sitemap.xml
Vysvětlení jednotlivých řádků:
| Řádek | Význam |
|---|---|
User-agent: * | Platí pro všechny boty (Google, Bing atd.) |
Disallow: /admin/ | Nedovolit botům vstup do adresáře /admin/ |
Disallow: /thanh-toan/ | Nedovolit botům vstup na platební stránku |
Disallow: /staging/ | Nedovolit botům vstup na stagingovou verzi |
Allow: / | Povolit botům procházet zbytek |
Sitemap: https://... | Říká botům, kde se nachází sitemap |
Zde je složitější příklad – vhodný pro podnikový web s blogem, stránkami služeb a administrační oblastí:
# Povolit všem botům procházet veřejný obsah
User-agent: *
Disallow: /admin/
Disallow: /wp-admin/
Disallow: /cart/
Disallow: /checkout/
Disallow: /my-account/
Disallow: /search?
Disallow: /*?ref=
Disallow: /*?utm_
# Povolit Googlebotu procházet CSS a JS (nutné pro vykreslení stránky)
User-agent: Googlebot
Allow: /wp-content/uploads/
Allow: /wp-includes/
Sitemap: https://example.com/sitemap.xml
📝 Poznámka pro vývojáře: Znak `*` v cestě je zástupný znak — `/ *?utm_` znamená blokování všech URL obsahujících parametr `?utm_`. Znak `$` na konci cesty slouží k přesnému shodě konce URL. Například: `Disallow: /*.pdf$` zablokuje všechny PDF soubory.
Jak robots.txt funguje v procesu SEO?
Abychom pochopili pozici robots.txt, podívejme se znovu na proces, jak Google dostává webové stránky do výsledků vyhledávání:
Crawl → Index → Rank
(Procházení) (Uložení) (Řazení)
Robots.txt funguje v první fázi – Crawl.
Než začne Googlebot procházet jakoukoli stránku na vašem webu, nejprve zkontroluje robots.txt. Pokud je URL uvedena v Disallow, Googlebot tuto stránku přeskočí – neprochází ji, nečte její obsah.
Googlebot chce procházet https://example.com/admin/settings
→ Zkontroluje robots.txt
→ Vidí Disallow: /admin/
→ Přeskočí, neprochází
Googlebot chce procházet https://example.com/dich-vu/
→ Zkontroluje robots.txt
→ Není blokováno
→ Prochází normálně → Indexuje → Může se objevit ve výsledcích vyhledávání
Robots.txt a sitemap: doplňující se dvojice
| Soubor | Role |
|---|---|
| Sitemap | „Toto je seznam stránek, o kterých chci, aby je Google věděl“ |
| Robots.txt | „Toto jsou stránky, které nechci, aby je Google procházel“ |
Tyto dva soubory si nekonkurují – pracují společně. Sitemap ukazuje cestu, robots.txt staví zábrany. Správnou kombinací můžete ovládat, co Google vidí a co na vašem webu ignoruje.
K čemu slouží robots.txt? 4 běžné případy
1. Skrytí administračních a interních stránek před Googlem
Administrační stránky, backend CMS, stagingové stránky, testovací stránky – to vše by se nemělo objevovat na Googlu. Robots.txt vám pomůže říct Googlu: „Sem nechoď.“
Disallow: /admin/
Disallow: /wp-admin/
Disallow: /staging/
2. Vyvarování se plýtvání „crawl budgetu“
Google neprochází neomezeně. Každý web má „crawl budget“ – počet stránek, které Googlebot navštíví při každé návštěvě. Pokud má web mnoho nevýznamných stránek (interní vyhledávání, filtrační stránky, stránkovací stránky), Googlebot může ztrácet čas jejich procházením místo důležitých stránek služeb nebo blogových příspěvků.
Disallow: /search?
Disallow: /tag/
Disallow: /page/
💡 Crawl budget je důležitý hlavně pro velké weby (tisíce stránek). Malé podnikové weby se o něj obvykle nemusí příliš starat, ale udržovat robots.txt v pořádku je stále dobrý zvyk.
3. Blokování duplicitního obsahu
Pokud více URL vede ke stejnému obsahu (např. URL s trackingovým parametrem ?utm_source=facebook nebo verze pro tisk ?print=true), můžete tyto duplicitní URL blokovat:
Disallow: /*?utm_
Disallow: /*?ref=
Disallow: /*?print=
4. Ukázání cesty k sitemapě
Robots.txt je první místo, které Googlebot při návštěvě webu kontroluje. Umístění cesty k sitemapě zde pomůže Googlu rychleji najít sitemapu – i když jste ji ještě neodeslali přes Search Console.
Sitemap: https://example.com/sitemap.xml
Kdy by se podnik měl zajímat o robots.txt?
Nemusíte robots.txt upravovat vždy. Ale existují okamžiky, kdy je kontrola tohoto souboru povinná:
Při spuštění nového webu (go-live)
Toto je nejdůležitější okamžik. Mnoho webů je zablokováno před procházením, protože vývojáři zapomněli odstranit řádek Disallow: / – který vložili během stagingu, aby Google neindexoval nedokončenou verzi.
Kontrola při spuštění:
| Kategorie | Jak zkontrolovat |
|---|---|
| Soubor robots.txt existuje | Otevřete https://nazev-domeny.com/robots.txt v prohlížeči |
| Není blokován celý web | Ujistěte se, že NEEXISTUJE řádek Disallow: / |
| Je deklarována sitemap | Ujistěte se, že EXISTUJE řádek Sitemap: https://nazev-domeny.com/sitemap.xml |
| Důležité stránky nejsou blokovány | Zkontrolujte, že stránky služeb, blogu, kontaktů nejsou v Disallow |
✅ Když se web po několika týdnech neindexuje na Googlu
Pokud máte sitemapu, poslali jste ji přes Search Console, ale Google ji stále neindexuje – robots.txt je prvním podezřelým, kterého je třeba zkontrolovat.
Při přidávání oblasti, kterou je třeba skrýt (členská sekce, interní stránky)
Pokud web doplňuje správu účtu, členskou oblast nebo interní stránky – aktualizujte robots.txt, abyste tyto oblasti zablokovali.
Při změně platformy webu nebo redesignu
Každá platforma (WordPress, Webflow, vlastní kód) vytváří jinou strukturu URL. Při migraci může starý robots.txt nesprávně zablokovat nové stránky nebo vynechat stránky, které je třeba blokovat.
Když Search Console hlásí chybu „Blocked by robots.txt“
Google Search Console má report Indexing, který ukazuje, které stránky jsou blokovány souborem robots.txt. Pokud vidíte důležitou stránku zablokovanou – je čas upravit soubor.
5 běžných chyb v robots.txt a jejich řešení
Chyba 1: Blokování celého webu – nejzávažnější chyba
Projev: Žádná stránka se neindexuje. Search Console hlásí hromadně „Blocked by robots.txt“.
Příčina: Soubor robots.txt obsahuje:
User-agent:
Disallow: /
Tyto dva řádky znamenají: „Zakázat všem botům vstup na jakoukoli stránku.“ To se obvykle stává, když vývojáři nastaví toto pravidlo během stagingu a zapomenou ho odstranit při spuštění.
Řešení: Upravte na:
User-agent: *
Disallow:
Sitemap: https://nazev-domeny.com/sitemap.xml
Disallow: (nic za dvojtečkou) = povolit procházení všeho.
⚠️ Toto je chyba číslo 1, kterou vidíme u nových podnikových webů. Po opravě může Googlu trvat několik dní až týdnů, než web znovu projde. Odešlete sitemapu znovu přes Search Console, abyste proces urychlili.
Chyba 2: Blokování CSS a JavaScriptu
Projev: Web se v prohlížeči zobrazuje normálně, ale při použití nástroje „URL Inspection“ v Search Console Google vidí, že stránka má rozbité rozvržení nebo prázdný obsah.
Příčina: Robots.txt blokuje adresáře obsahující CSS a JS:
Disallow: /wp-content/
Disallow: /wp-includes/
Google potřebuje číst CSS a JS, aby pochopil, jak stránka vypadá (tzv. „rendering“). Pokud je to zablokováno, Google stránku nevykreslí → nepochopí obsah → ovlivní to řazení.
Řešení:
User-agent: *
Disallow: /wp-admin/
Allow: /wp-admin/admin-ajax.php
Allow: /wp-content/
Allow: /wp-includes/
📝 Poznámka pro vývojáře: Od roku 2014 Google jasně doporučuje: neblokujte CSS, JS a obrázky v robots.txt. Googlebot potřebuje tyto zdroje, aby stránku správně vykreslil. Použijte nástroj URL Inspection v Search Console, abyste zkontrolovali, jak Google vaši stránku vykresluje.
Chyba 3: Nesprávné zablokování důležité stránky
Projev: Stránka služby, produktu nebo blogový příspěvek se nezobrazuje na Googlu – i když je v sitemapě.
Příčina: Pravidlo v robots.txt je příliš obecné. Například:
Disallow: /dich-vu
Tento řádek blokuje nejen /dich-vu/, ale také /dich-vu-thiet-ke-web/, /dich-vu-seo/ a jakoukoli URL začínající /dich-vu.
Řešení: Přidejte lomítko / na konec cesty, abyste zablokovali přesný adresář:
Disallow: /dich-vu-noi-bo/
Nebo použijte Allow k ochraně potřebné stránky:
Disallow: /dich-vu-noi-bo/
Allow: /dich-vu/
Allow: /dich-vu-thiet-ke-web/
📝 Poznámka pro vývojáře: Pořadí `Allow` a `Disallow` má vliv. Googlebot používá nejpřesnější cestu (most specific path). Pokud je délka stejná, `Allow` má přednost před `Disallow`. Vždy testujte pomocí [Robots Testing Tool](https://support.google.com/webmasters/answer/6062598) v Search Console před nasazením.
Chyba 4: Absence souboru robots.txt
Projev: Zadání nazev-domeny.com/robots.txt → vrátí chybu 404.
Příčina: Web je vytvořen ručně a vývojář nevytvořil tento soubor. Nebo byl soubor omylem smazán při nasazení.
Dopad: Ne tak vážný jako chyba 1 – pokud robots.txt neexistuje, Google ve výchozím stavu prochází vše. Ale to znamená:
- Google bude procházet administrační stránky, testovací stránky, interní stránky
- Nemáte způsob, jak ukázat cestu k sitemapě přes robots.txt
- Chybí základní kontrola
Řešení: Vytvořte soubor robots.txt v kořenovém adresáři. Minimální obsah:
User-agent: *
Disallow: /admin/
Disallow: /search?
Sitemap: https://nazev-domeny.com/sitemap.xml
Chyba 5: Použití robots.txt ke skrytí stránky před Googlem (nesprávné pochopení účelu)
Projev: Zablokujete stránku pomocí Disallow, ale stránka se stále objevuje na Googlu – i když bez snippetu obsahu.
Příčina: Robots.txt blokuje procházení, ne indexování. Pokud byla stránka již dříve indexována nebo má zpětný odkaz z jiného webu, Google může URL ve výsledcích vyhledávání ponechat – pouze nezobrazuje obsah.
Správné řešení:
| Cíl | Co použít |
|---|---|
| Nechcete, aby Google procházel (skenoval) | Disallow v robots.txt |
| Nechcete, aby Google indexoval (zobrazoval) | Tag v HTML |
| Nechcete ani jedno | Použijte `noindex` v HTML (a neblokujte v robots.txt) |
⚠️ Toto je nejčastěji špatně pochopený bod: Pokud zablokujete procházení (robots.txt) a zároveň nastavíte `noindex` (HTML), Google neuvidí noindex tag, protože stránku neprochází — a stránka se může stále indexovat. Řešení: Použijte `noindex` v HTML a odstraňte pravidlo `Disallow` pro tuto stránku v robots.txt.
Ukázka robots.txt pro podnikový web
Zde je ukázkový soubor robots.txt vhodný pro většinu malých a středních podnikových webů:
# =============================================
# Robots.txt pro podnikový web
# Aktualizováno: 2026-04-20
# =============================================
# Platí pro všechny boty
User-agent: *
# Blokovat administrační a interní oblasti
Disallow: /admin/
Disallow: /wp-admin/
Disallow: /dashboard/
Disallow: /staging/
# Blokovat interní vyhledávací stránky (vyhnout se plýtvání crawl budgetem)
Disallow: /search?
Disallow: /*?s=
# Blokovat URL s trackingovými parametry (vyhnout se duplicitnímu obsahu)
Disallow: /*?utm_
Disallow: /*?ref=
Disallow: /*?fbclid=
# Blokovat košík / platební stránky (pokud existují)
Disallow: /cart/
Disallow: /checkout/
Disallow: /my-account/
# Povolit CSS, JS, obrázky (Google je potřebuje pro vykreslení stránky)
Allow: /wp-content/uploads/
Allow: /wp-content/themes/
Allow: /wp-includes/
# Ukázat cestu k sitemapě
Sitemap: https://nazev-domeny.com/sitemap.xml
📝 Poznámka pro vývojáře: Soubor robots.txt musí být umístěn v kořenovém adresáři domény — `https://example.com/robots.txt`. Ne v `/blog/robots.txt` nebo jiném podadresáři. Každý subdoména potřebuje vlastní robots.txt (např. `blog.example.com/robots.txt` je odděleno od `example.com/robots.txt`).
Jak zkontrolovat robots.txt vašeho webu
Metoda 1: Přímá kontrola v prohlížeči
Zadejte https://vas-nazev-domeny.com/robots.txt do adresního řádku. Uvidíte obsah souboru ve formátu textu. Pokud vidíte chybu 404 – robots.txt na webu ještě není.
Metoda 2: Použití Google Search Console
- Přihlaste se do Google Search Console
- Přejděte do sekce Settings → Crawling → robots.txt
- Zobrazte si soubor robots.txt, který Google čte
- Zkontrolujte, zda konkrétní URL není blokována
Metoda 3: Kontrola v reportu Indexing
V Search Console → Pages (nebo Indexing) → Najděte sekci „Blocked by robots.txt“. Pokud je v tomto seznamu důležitá stránka – musíte ihned opravit robots.txt.
💡 Robots.txt byste měli kontrolovat alespoň jednou za čtvrt roku nebo kdykoli dojde k významné změně na webu (přidání stránek, změna struktury, migrace platformy).
Souhrnná tabulka: Co by měl robots.txt blokovat a co ne
| ✅ MĚLI BYSTE blokovat | ❌ NEMĚLI BYSTE blokovat |
|---|---|
Administrační stránky (/admin/, /wp-admin/) | Domovská stránka, stránky služeb, kontaktní stránka |
| Staging / testovací stránky | Blogové příspěvky, články |
Interní vyhledávací stránky (/search?) | CSS a JavaScript soubory |
URL s trackingovými parametry (?utm_, ?fbclid=) | Obrázky (Google Images také přináší návštěvnost) |
| Stránky košíku, platby, osobního účtu | Sitemap |
| Stránky s duplicitním obsahem (filtry, řazení, stránkování) | FAQ, případové studie |
Často kladené otázky o robots.txt
Jaký je rozdíl mezi robots.txt a sitemapou?
Sitemap říká: „Toto jsou stránky, o kterých chci, aby je Google věděl.“ Robots.txt říká: „Toto jsou stránky, které nechci, aby je Google procházel.“ Oba soubory se doplňují – sitemap ukazuje cestu dovnitř, robots.txt staví zábrany.
Pokud robots.txt neexistuje, bude Google procházet web?
Ano. Pokud robots.txt neexistuje, Google ve výchozím stavu prochází všechny stránky – včetně těch, které nechcete. Proto je důležité mít tento soubor.
Používám WordPress, kde najdu robots.txt?
WordPress sám vytváří virtuální robots.txt. Pokud používáte SEO plugin jako Yoast nebo Rank Math, můžete robots.txt upravovat přímo v pluginu, aniž byste museli přistupovat k serveru.
Ovlivňuje robots.txt rychlost webu?
Ne. Tento soubor má jen několik KB. Neovlivňuje rychlost načítání stránek.
Blokoval jsem stránku pomocí robots.txt, proč se stále objevuje na Googlu?
Protože robots.txt blokuje procházení, ne indexování. Pokud chcete, aby stránka zcela zmizela z Googlu, použijte tag v HTML – a neblokujte tuto stránku v robots.txt (aby Google mohl přečíst noindex tag).
Po úpravě robots.txt, jak dlouho bude trvat, než Google aktualizuje?
Google obvykle kontroluje robots.txt znovu do 24-48 hodin. Můžete v Search Console → Settings → Crawling požádat Google o dřívější kontrolu.
Závěr
Robots.txt je malý soubor – obvykle jen pár řádků – ale má přímý vliv na to, zda Google váš web uvidí.
Co si pamatovat:
- Robots.txt je cedule „Omezený přístup“: říká Googlu, které stránky nemá procházet
- Zkontrolujte při spuštění webu: chyba blokující celý web je běžná a závažná
- Nepoužívejte robots.txt ke skrytí stránek před Googlem: blokuje procházení, ne indexování
- Vždy povolte CSS a JS: Google je potřebuje pro vykreslení stránky a pochopení obsahu
- Kombinujte se sitemapou a Search Console: pro úplnou kontrolu nad tím, co Google prochází a indexuje
Zkontrolujte platformu svého webu
Robots.txt je jen jedním z mnoha technických faktorů ovlivňujících SEO. Pokud si kladete otázku: „Je můj web správně nastaven?“ – odpověď leží v platformě, kterou používáte.
GTG CRM vám pomůže vytvořit web s korektním robots.txt, automatickou sitemapou a technickou strukturou připravenou pro Google – nemusíte se starat o úpravy jednotlivých souborů a řádků kódu.
Proměňte právě přečtené informace v reálné výsledky – aplikujte je hned s GTG CRM, zdarma.
Aplikujte hned