Co je robots.txt a kdy by se o něj měla firma zajímat?
Máte sitemap, poslali jste ji Googlu a web se začíná indexovat. Ale jednoho dne zjistíte, že se na Googlu objevuje administrační stránka, interní platební stránka nebo stagingová verze webu. Zákazník zadá název firmy – a hned vidí i nedokončenou testovací stránku.
Nebo naopak: napíšete nový článek na blog, počkáte dva týdny a na Googlu se stále neobjevuje. Zeptáte se technické podpory, a ta vám řekne: „Soubor robots.txt brání Googlu ve procházení celého webu.“
Obě situace souvisejí s malým souborem, který mnoho správců webu přehlíží: robots.txt.
Tento článek jednoduše a s praktickými příklady vysvětlí, co je robots.txt, jak funguje, kdy ho potřebujete upravit a jakým běžným chybám by se firmy měly vyhnout.
Co je robots.txt? Vysvětlení pro správce webu
Pokud je sitemap jako půdorys budovy – Google říká, jaké jsou místnosti – pak je robots.txt jako cedule „Vstup zakázán“ – říká Googlu, do kterých místností nesmí.
Technicky řečeno: robots.txt je malý textový soubor umístěný v kořenovém adresáři webu (např. https://example.com/robots.txt). Tento soubor obsahuje pravidla (rules), která říkají botům vyhledávačů – jako je Googlebot – co:
- Stránky, které smí procházet (crawl)
- Stránky, které nesmí procházet
- Kde se nachází sitemap
Robots.txt libovolného webu si můžete prohlédnout zadáním: nazev-domeny.cz/robots.txt do prohlížeče.
💡 Důležité: robots.txt je pouze zdvořná žádost, nikoli absolutní zákaz. Renomovaní boti jako Googlebot ji budou respektovat, ale zlí boti (spameři, scrapers) ji mohou ignorovat. Pokud potřebujete skutečné zabezpečení, použijte heslo nebo firewall – nespoléhejte se na robots.txt.
Jak soubor robots.txt vypadá?
Nemusíte ho psát od začátku. Ale abyste pochopili, co vidíte, zde je jednoduchý soubor robots.txt:
User-agent: *
Disallow: /admin/
Disallow: /platba/
Disallow: /staging/
Allow: /
Sitemap: https://example.com/sitemap.xml
Vysvětlení jednotlivých řádků:
| Řádek | Význam |
|---|---|
User-agent: * | Platí pro všechny boty (Google, Bing atd.) |
Disallow: /admin/ | Botům je zakázáno vstupovat do adresáře /admin/ |
Disallow: /platba/ | Botům je zakázáno vstupovat na platební stránku |
Disallow: /staging/ | Botům je zakázáno vstupovat do stagingové verze |
Allow: / | Botům je povoleno procházet zbytek webu |
Sitemap: https://... | Informuje boty, kde se nachází sitemap |
Zde je složitější příklad – vhodný pro web firmy s blogem, servisními stránkami a administrační oblastí:
# Povolit všem botům procházet veřejný obsah
User-agent: *
Disallow: /admin/
Disallow: /wp-admin/
Disallow: /kosik/
Disallow: /pokladna/
Disallow: /muj-ucet/
Disallow: /hledat?
Disallow: /*?ref=
Disallow: /*?utm_
# Povolit Googlebotu procházet CSS a JS (nezbytné pro vykreslení stránky)
User-agent: Googlebot
Allow: /wp-content/uploads/
Allow: /wp-includes/
Sitemap: https://example.com/sitemap.xml
📝 Poznámka pro vývojáře: Znak
*v cestě je zástupný znak –/*?utm_znamená blokování všech URL obsahujících parametr?utm_. Znak$na konci cesty se používá k přesné shodě s koncem URL. Např.:Disallow: /*.pdf$zablokuje všechny soubory PDF.
---
Jak robots.txt funguje v procesu SEO?
Abychom pochopili místo robots.txt, podívejme se na proces, jak Google zařazuje web do výsledků vyhledávání:
Crawl → Index → Rank
(Procházení) (Ukládání) (Řazení)
Robots.txt funguje v první fázi – Crawl.
Než začne Googlebot procházet jakoukoli stránku na vašem webu, nejprve zkontroluje robots.txt. Pokud je URL uvedena v Disallow, Googlebot tuto stránku přeskočí – nebude ji procházet, číst její obsah.
Googlebot chce procházet https://example.com/admin/nastaveni
→ Zkontroluje robots.txt
→ Najde Disallow: /admin/
→ Přeskočí, neprochází
Googlebot chce procházet https://example.com/sluzby/
→ Zkontroluje robots.txt
→ Není blokováno
→ Normálně prochází → Indexuje → Může se objevit ve výsledcích vyhledávání
Robots.txt a sitemap: doplňující se duo
| Soubor | Role |
|---|---|
| Sitemap | „Toto je seznam stránek, které chci, aby Google znal.“ |
| Robots.txt | „Toto jsou stránky, které nechci, aby Google procházel.“ |
Tyto dva soubory si nekonkurují – spolupracují. Sitemap ukazuje cestu, robots.txt staví zábrany. Správnou kombinací kontrolujete, co Google na vašem webu vidí a co ignoruje.
K čemu slouží robots.txt? 4 běžné případy
1. Skrytí administračních a interních stránek před Googlem
Administrační stránky, backend CMS, stagingové stránky, testovací stránky – to vše by se nemělo objevovat na Googlu. Robots.txt vám pomůže říct Googlu: „Nechoď sem.“
Disallow: /admin/
Disallow: /wp-admin/
Disallow: /staging/
2. Vyhnutí se plýtvání „crawl budgetem“
Google neprochází neomezeně. Každý web má svůj „crawl budget“ – počet stránek, které Googlebot při každé návštěvě projde. Pokud má web mnoho nepodstatných stránek (interní vyhledávací stránky, filtrační stránky, stránky s paginací), Googlebot může být zaneprázdněn jejich procházením místo důležitých servisních stránek nebo blogových příspěvků.
Disallow: /hledat?
Disallow: /tag/
Disallow: /stranka/
💡 Crawl budget je důležitý hlavně pro velké weby (tisíce stránek). Menší firemní weby se o něj obvykle nemusí příliš starat, ale udržování čistého robots.txt je stále dobrým zvykem.
3. Blokování duplicitního obsahu
Pokud na webu existuje více URL vedoucích ke stejnému obsahu (např. URL s parametry sledování ?utm_source=facebook nebo verze pro tisk ?print=true), můžete tyto duplicitní URL zablokovat:
Disallow: /*?utm_
Disallow: /*?ref=
Disallow: /*?print=
4. Ukázání cesty k sitemapě
Robots.txt je první místo, které Googlebot zkontroluje, když přijde na web. Umístěním cesty k sitemapě sem pomůžete Googlu najít ji rychleji – i když jste ji ještě neposlali přes Search Console.
Sitemap: https://example.com/sitemap.xml
Kdy by se měla firma o robots.txt zajímat?
Nemusíte vždy upravovat robots.txt. Ale existují okamžiky, kdy je kontrola tohoto souboru nezbytná:
Při spuštění nového webu (go-live)
Toto je nejdůležitější okamžik. Mnoho webů je zcela zablokováno pro procházení, protože vývojáři zapomněli odstranit řádek Disallow: / – který nastavili během stagingu, aby Google neindexoval nedokončenou verzi.
Kontrola při go-live:
| Kategorie | Způsob kontroly |
|---|---|
| Soubor robots.txt existuje | Otevřete https://nazev-domeny.cz/robots.txt v prohlížeči |
| Nezablokuje celý web | Ujistěte se, že NEEXISTUJE řádek Disallow: / |
| Sitemap je deklarována | Ujistěte se, že EXISTUJE řádek Sitemap: https://nazev-domeny.cz/sitemap.xml |
| Důležité stránky nejsou blokovány | Zkontrolujte, že servisní, kontaktní a blogové stránky nejsou v Disallow |
✅ Když se web po několika týdnech neindexuje na Googlu
Pokud máte sitemapu, poslali jste ji přes Search Console, ale Google ji stále neindexuje – robots.txt je prvním podezřelým, kterého je třeba zkontrolovat.
Při přidání oblasti, která má být skryta (členské sekce, interní stránky)
Pokud web přidává stránky pro správu účtu, členské sekce nebo interní stránky – aktualizujte robots.txt tak, aby tyto oblasti blokoval.
Při změně platformy webu nebo redesignu
Každá platforma (WordPress, Webflow, vlastní kód) vytváří jinou strukturu URL. Při migraci může starý robots.txt nesprávně blokovat nové stránky nebo opomenout blokování stránek, které mají být skryty.
Když Search Console hlásí chybu „Blocked by robots.txt“
Google Search Console má přehled Indexing, který ukazuje, které stránky jsou blokovány robots.txt. Pokud vidíte, že jsou blokovány důležité stránky – je čas upravit soubor.
5 běžných chyb v robots.txt a jejich řešení
Chyba 1: Blokování celého webu – nejzávažnější chyba
Projev: Žádná stránka není indexována Googlu. Search Console hlásí mnoho stránek „Blocked by robots.txt“.
Příčina: Soubor robots.txt obsahuje:
User-agent:
Disallow: /
Tyto dva řádky znamenají: „Zákaz všem botům vstupovat na jakoukoli stránku.“ Obvykle se to stává, když vývojář nastaví toto pravidlo během stagingu a zapomene ho odstranit při spuštění.
Řešení: Upravte na:
User-agent: *
Disallow:
Sitemap: https://nazev-domeny.cz/sitemap.xml
Disallow: (bez ničeho za dvojtečkou) = povolení procházení všeho.
⚠️ Toto je chyba číslo 1, kterou vidíme na nových firemních webech. Po opravě může Googlu trvat několik dní až týdnů, než web znovu projde. Pošlete sitemapu znovu přes Search Console, abyste proces urychlili.
---
Chyba 2: Blokování CSS a JavaScriptu
Projev: Web se na prohlížeči zobrazuje normálně, ale při použití nástroje „URL Inspection“ v Search Console Google vidí, že se stránka rozpadla nebo je prázdná.
Příčina: Robots.txt blokuje adresáře obsahující CSS a JS:
Disallow: /wp-content/
Disallow: /wp-includes/
Google potřebuje číst CSS a JS, aby pochopil, jak stránka vypadá (tzv. „rendering“). Pokud je blokován, Google stránku nevykreslí → nepochopí obsah → ovlivní to hodnocení.
Řešení:
User-agent: *
Disallow: /wp-admin/
Allow: /wp-admin/admin-ajax.php
Allow: /wp-content/
Allow: /wp-includes/
📝 Poznámka pro vývojáře: Od roku 2014 Google výslovně doporučuje: neblokovat CSS, JS a obrázky v robots.txt. Googlebot potřebuje tyto zdroje k správnému vykreslení stránky. Použijte nástroj URL Inspection v Search Console, abyste zkontrolovali, jak Google vaši stránku vykresluje.
Chyba 3: Nesprávné zablokování důležitých stránek
Projev: Servisní, produktové nebo blogové stránky se neobjevují na Googlu – i když je sitemap obsahuje.
Příčina: Pravidlo v robots.txt je příliš obecné. Např.:
Disallow: /sluzby
Tento řádek blokuje nejen /sluzby/, ale také /sluzby-webdesignu/, /sluzby-seo/ a jakoukoli URL začínající na /sluzby.
Řešení: Přidejte lomítko / na konec cesty, abyste zablokovali přesně adresář:
Disallow: /interni-sluzby/
Nebo použijte Allow k ochraně potřebné stránky:
Disallow: /interni-sluzby/
Allow: /sluzby/
Allow: /sluzby-webdesignu/
📝 Poznámka pro vývojáře: Pořadí
AllowaDisallowmá vliv. Googlebot používá nejpřesnější cestu (most specific path). Při stejné délce máAllowpřednost předDisallow. Vždy testujte pomocí Nástroje pro testování robots.txt v Search Console před nasazením.
Chyba 4: Absence souboru robots.txt
Projev: Zadání nazev-domeny.cz/robots.txt vrátí chybu 404.
Příčina: Web je ručně vytvořen a vývojář tento soubor nevytvořil. Nebo byl soubor omylem smazán při nasazení.
Dopad: Není tak vážný jako chyba 1 – pokud robots.txt neexistuje, Google standardně prochází vše. Ale znamená to:
- Google bude procházet administrační stránky, testovací stránky, interní stránky
- Nemáte způsob, jak ukázat cestu k sitemapě přes robots.txt
- Chybí základní kontrola
Řešení: Vytvořte soubor robots.txt v kořenovém adresáři. Minimální obsah:
User-agent: *
Disallow: /admin/
Disallow: /hledat?
Sitemap: https://nazev-domeny.cz/sitemap.xml
---
Chyba 5: Použití robots.txt k skrytí stránky před Googlem (nesprávné pochopení účelu)
Projev: Zablokujete stránku pomocí Disallow, ale stránka se stále objevuje na Googlu – i když bez popisu obsahu.
Příčina: Robots.txt blokuje procházení, nikoli indexování. Pokud byla stránka již dříve indexována nebo na ni odkazuje jiný web, Google může URL ve výsledcích vyhledávání ponechat – pouze nezobrazí obsah.
Správné řešení:
| Cíl | Co použít |
|---|---|
| Nechci, aby Google procházel (skenoval) | Disallow v robots.txt |
| Nechci, aby Google indexoval (zobrazoval) | Tag v HTML |
| Nechci ani jedno | Použijte noindex v HTML (a neblokujte v robots.txt) |
⚠️ Toto je nejčastěji špatně pochopený bod: Pokud zablokujete procházení (robots.txt) a zároveň nastavíte
noindex(HTML), Google si nevšimne tagu noindex, protože stránku neprochází – a stránka může být stále indexována. Řešení: použijtenoindexv HTML a odstraňte pravidloDisallowpro danou stránku z robots.txt.
Vzorový robots.txt pro firemní web
Zde je vzorový soubor robots.txt vhodný pro většinu malých a středních firemních webů:
# =============================================
# Robots.txt pro firemní web
# Aktualizováno: 2026-04-20
# =============================================
# Platí pro všechny boty
User-agent: *
# Blokovat administrační a interní oblasti
Disallow: /admin/
Disallow: /wp-admin/
Disallow: /dashboard/
Disallow: /staging/
# Blokovat interní vyhledávací stránky (vyhnout se plýtvání crawl budgetem)
Disallow: /hledat?
Disallow: /*?s=
# Blokovat URL s parametry pro sledování (vyhnout se duplicitnímu obsahu)
Disallow: /*?utm_
Disallow: /*?ref=
Disallow: /*?fbclid=
# Blokovat nákupní košík / platební stránky (pokud existují)
Disallow: /kosik/
Disallow: /pokladna/
Disallow: /muj-ucet/
# Povolit CSS, JS, obrázky (Google je potřebuje k vykreslení stránky)
Allow: /wp-content/uploads/
Allow: /wp-content/themes/
Allow: /wp-includes/
# Ukázat cestu k sitemapě
Sitemap: https://nazev-domeny.cz/sitemap.xml
📝 Poznámka pro vývojáře: Soubor robots.txt musí být umístěn v kořenovém adresáři domény –
https://example.com/robots.txt. Nikoli/blog/robots.txtnebo v jiném podadresáři. Každá subdoména potřebuje vlastní robots.txt (např.blog.example.com/robots.txtje oddělený odexample.com/robots.txt).
Jak zkontrolovat robots.txt vašeho webu
Metoda 1: Přímá kontrola v prohlížeči
Zadejte https://nazev-vasí-domény.cz/robots.txt do adresního řádku. Uvidíte obsah souboru ve formátu textu. Pokud vidíte chybu 404 – robots.txt na webu ještě není.
Metoda 2: Použití Google Search Console
- Přihlaste se do Google Search Console
- Přejděte do sekce Nastavení → Procházení → robots.txt
- Zobrazte si soubor robots.txt, který Google čte
- Zkontrolujte, zda není konkrétní URL blokována
Metoda 3: Kontrola v přehledu Indexování
V Search Console → Stránky (nebo Indexování) → Najděte sekci „Blocked by robots.txt“. Pokud jsou v tomto seznamu důležité stránky, musíte robots.txt okamžitě opravit.
💡 Robots.txt byste měli kontrolovat alespoň jednou za čtvrtletí nebo pokaždé, když dojde k zásadní změně na webu (přidání stránek, změna struktury, migrace platformy).
Shrnutí: Co by měl robots.txt blokovat a co ne
| ✅ MĚLI BYSTE blokovat | ❌ NEMĚLI BYSTE blokovat |
|---|---|
Administrační stránky (/admin/, /wp-admin/) | Domovská stránka, servisní stránky, kontaktní stránky |
| Staging / testovací stránky | Blogové příspěvky, články |
Interní vyhledávací stránky (/search?) | CSS a JavaScript soubory |
URL s parametry pro sledování (?utm_, ?fbclid=) | Obrázky (Google Images také generuje návštěvnost) |
| Stránky nákupního košíku, platby, osobního účtu | Sitemap |
| Stránky s duplicitním obsahem (filtry, řazení, paginace) | FAQ stránky, případové studie |
---
Často kladené otázky o robots.txt
Jaký je rozdíl mezi robots.txt a sitemapou?
Sitemap říká: „Toto jsou stránky, o kterých chci, aby je Google znal.“ Robots.txt říká: „Toto jsou stránky, které nechci, aby je Google procházel.“ Tyto dva soubory se vzájemně doplňují – sitemap ukazuje cestu dovnitř, robots.txt staví zábrany.
Pokud robots.txt neexistuje, může Google procházet web?
Ano. Bez robots.txt Google standardně prochází všechny stránky – včetně těch, které nechcete. Proto je důležité mít tento soubor.
Používám WordPress, kde najdu robots.txt?
WordPress vytváří virtuální robots.txt. Pokud používáte SEO plugin jako Yoast nebo Rank Math, můžete robots.txt upravovat přímo v pluginu, aniž byste se museli přihlašovat na server.
Ovlivňuje robots.txt rychlost webu?
Ne. Tento soubor má jen několik KB. Neovlivňuje rychlost načítání stránek.
Blokoval jsem stránku pomocí robots.txt, proč se stále objevuje na Googlu?
Protože robots.txt blokuje procházení, nikoli indexování. Pokud byla stránka již dříve indexována, nebo na ni odkazuje jiný web, Google ji může ve výsledcích vyhledávání ponechat – pouze nezobrazí obsah. Abyste stránku úplně odstranili z Googlu, použijte tag v HTML – a neblokujte tuto stránku v robots.txt (aby Google mohl přečíst noindex tag).
Jak dlouho trvá, než Google zaktualizuje robots.txt po jeho úpravě?
Google obvykle kontroluje robots.txt znovu do 24-48 hodin. Můžete v Search Console → Nastavení → Procházení požádat Google o dřívější kontrolu.
Závěr
Robots.txt je malý soubor – obvykle jen několik řádků – ale má přímý vliv na to, zda Google váš web vůbec uvidí.
Co si pamatovat:
- Robots.txt je cedule „Vstup zakázán“: říká Googlu, které stránky nemá procházet
- Zkontrolujte ho při spuštění webu: chyba blokování celého webu je běžná a vážná
- Nepoužívejte robots.txt ke skrytí stránek před Googlem: blokuje procházení, ne indexování
- Vždy povolte CSS a JS: Google je potřebuje k vykreslení stránky
- Kombinujte ho se sitemapou a Search Console: pro úplnou kontrolu nad tím, co Google prochází a indexuje na vašem webu
Zkontrolujte platformu svého webu
Robots.txt je jen jedním z mnoha technických faktorů ovlivňujících SEO. Pokud si kladete otázku: „Je můj web správně nastaven?“ – odpověď spočívá v platformě, kterou používáte.
GTG CRM vám pomůže vytvořit web s korektním robots.txt, automatizovanou sitemapou a technickou strukturou připravenou pro Google – nemusíte se starat o úpravu jednotlivých souborů a řádků kódu.
Převeďte to, co jste se právě naučili, do praktických výsledků – vyzkoušejte GTG CRM zdarma.
Vyzkoušet hned