Máte sitemap, odeslali jste ji Googlu a web se začíná indexovat. Ale jednoho dne zjistíte, že se na Google zobrazuje i vaše administrační stránka, interní platební stránka nebo stagingová stránka webu. Zákazník zadá název vaší firmy a hned vidí i nedokončenou testovací stránku.

Nebo naopak: zveřejníte nový blogový příspěvek, čekáte dva týdny a stále se neobjevuje na Googlu. Zeptáte se technické podpory a oni vám řeknou: „Soubor robots.txt blokuje Google před prohledáním celého webu.“

Obě situace souvisejí s malým souborem, který správci webu často přehlížejí: robots.txt.

Tento článek vysvětlí, co je robots.txt, jak funguje, kdy ho potřebujete upravit a jakým běžným chybám by se firmy měly vyhnout – vše jednoduše, s praktickými příklady.

Co je robots.txt? Vysvětlení pro správce webu

Pokud je sitemap jako mapa budovy – říká Googlu, jaké jsou místnosti –, pak robots.txt je cedule „Omezený vstup“ – říká Googlu, do kterých místností nemá vstupovat.

Technicky řečeno: robots.txt je malý textový soubor umístěný v kořenovém adresáři webu (např.: https://example.com/robots.txt). Tento soubor obsahuje pravidla, která říkají botům vyhledávacích nástrojů – jako je Googlebot –:

  • Které stránky mohou být prohledány (crawl)
  • Které stránky nesmí být prohledány
  • Kde se nachází sitemap

robots.txt jakéhokoli webu si můžete prohlédnout zadáním: nazev-domeny.cz/robots.txt do prohlížeče.

💡 Důležité: robots.txt je pouze zdvořilá žádost, nikoli absolutní zákaz. Renomovaní boti jako Googlebot se jím řídí, ale zlomyslní boti (spammeři, scrapers) ho mohou ignorovat. Pokud potřebujete skutečné zabezpečení, použijte heslo nebo firewall – nespoléhejte se na robots.txt.

Jak soubor robots.txt vypadá?

Tento soubor nemusíte psát od začátku. Ale abyste mu rozuměli, když se na něj podíváte, zde je jednoduchý soubor robots.txt:

User-agent: *
Disallow: /admin/
Disallow: /thanh-toan/
Disallow: /staging/
Allow: /

Sitemap: https://example.com/sitemap.xml

Vysvětlení jednotlivých řádků:

ŘádekVýznam
User-agent: *Platí pro všechny boty (Google, Bing atd.)
Disallow: /admin/Nedovoluje botům vstup do adresáře /admin/
Disallow: /thanh-toan/Nedovoluje botům vstup na platební stránku
Disallow: /staging/Nedovoluje botům vstup do stagingové verze
Allow: /Dovoluje botům prohledat zbytek webu
Sitemap: https://...Říká botům, kde se nachází sitemap

Zde je složitější příklad – vhodný pro firemní web s blogem, stránkami služeb a administrační oblastí:

# Povoluje všem botům prohledávat veřejný obsah
User-agent: *
Disallow: /admin/
Disallow: /wp-admin/
Disallow: /cart/
Disallow: /checkout/
Disallow: /my-account/
Disallow: /search?
Disallow: /*?ref=
Disallow: /*?utm_

# Povoluje Googlebotu prohledávat CSS a JS (nezbytné pro vykreslení stránky)
User-agent: Googlebot
Allow: /wp-content/uploads/
Allow: /wp-includes/

Sitemap: https://example.com/sitemap.xml
📝 Poznámka pro vývojáře: Znak `` v cestě je zástupný znak (wildcard) – `/?utm_` znamená blokování všech URL obsahujících parametr `?utm_`. Znak `$` na konci cesty se používá k přesnému shodě na konci URL. Například: `Disallow: /*.pdf$` zablokuje všechny soubory PDF.

Jak robots.txt funguje v procesu SEO?

Abyste pochopili místo robots.txt, podívejte se znovu na proces, jak Google přidává webové stránky do výsledků vyhledávání:

Crawl → Index → Rank
(Prohledávání) (Uložení) (Řazení)

Robots.txt funguje v prvním kroku - Crawl.

Než Googlebot začne procházet jakoukoli stránku na vašem webu, nejprve zkontroluje robots.txt. Pokud je URL uvedena v sekci Disallow, Googlebot ji přeskočí – nebude ji procházet ani číst její obsah.

Googlebot chce prohledat https://example.com/admin/settings
→ Zkontroluje robots.txt
→ Najde Disallow: /admin/
→ Přeskočí, nebude prohledávat

Googlebot chce prohledat https://example.com/sluzby/
→ Zkontroluje robots.txt
→ Není blokováno
→ Prohledává normálně → Indexuje → Může se zobrazit ve výsledcích vyhledávání

Robots.txt a sitemap: doplňující se dvojice

SouborRole
Sitemap„Toto je seznam stránek, o kterých chci, aby je Google věděl“
Robots.txt„Toto jsou stránky, které nechci, aby je Google procházel“

Tyto dva soubory si nekonkurují – fungují společně. Sitemap ukazuje cestu, robots.txt staví bariéry. Správným kombinováním můžete ovládat, co Google na vašem webu vidí a co ignoruje.

K čemu slouží robots.txt? 4 běžné případy

1. Skrytí administrátorských a interních stránek před Googlem

Administrátorské stránky, backend CMS, stagingové stránky, testovací stránky – to vše by se nemělo zobrazovat na Googlu. Robots.txt vám pomůže říct Googlu: „Sem nechoď.“

Disallow: /admin/
Disallow: /wp-admin/
Disallow: /staging/

2. Předcházení plýtvání „crawl budgetem“

Google neprohledává neomezeně. Každý web má svůj „crawl budget“ – počet stránek, které Googlebot při každé návštěvě prohledá. Pokud má web mnoho nevýznamných stránek (stránky interního vyhledávání, filtrovací stránky, stránky s paginací), Googlebot se může zabývat jejich prohledáváním namísto důležitých stránek služeb nebo blogových příspěvků.

Disallow: /search?
Disallow: /tag/
Disallow: /page/
💡 Crawl budget je důležitý především pro velké weby (tisíce stránek). Malé firemní weby si s tím obvykle nemusí tolik starat, ale udržování čistého robots.txt je stále dobrý zvyk.

3. Blokování duplicitního obsahu

Pokud váš web má více URL vedoucích ke stejnému obsahu (např. URL s parametry sledování ?utm_source=facebook nebo tiskovou verzí ?print=true), můžete tyto duplicitní URL blokovat:

Disallow: /*?utm_
Disallow: /*?ref=
Disallow: /*?print=

4. Směřování k sitemapě

Robots.txt je první místo, které Googlebot při návštěvě webu zkontroluje. Uvedení cesty k sitemapě zde pomůže Googlu najít sitemapu rychleji – i když jste ji ještě neodeslali přes Search Console.

Sitemap: https://example.com/sitemap.xml

Kdy by se měl podnik zajímat o robots.txt?

Nemusíte robots.txt upravovat vždy. Existují však okamžiky, kdy je kontrola tohoto souboru nezbytná:

Když je nový web spuštěn (go-live)

Toto je nejdůležitější okamžik. Mnoho webů je zcela zablokováno pro procházení, protože vývojáři zapomněli odstranit řádek Disallow: / – řádek, který umístili během stagingu, aby Google neindexoval nedokončenou verzi.

Kontrola při spuštění:

KategorieJak zkontrolovat
Soubor robots.txt existujeOtevřete https://domena.com/robots.txt v prohlížeči
Nezablokuje celý webUjistěte se, že NEEXISTUJE řádek Disallow: /
Sitemap je definovánaUjistěte se, že EXISTUJE řádek Sitemap: https://domena.com/sitemap.xml
Důležité stránky nejsou blokoványZkontrolujte, zda se stránky služeb, blogu nebo kontaktů nenacházejí v sekci Disallow

✅ Když Google neindexuje web po několika týdnech

Pokud již máte sitemapu a odeslali jste ji přes Search Console, ale Google ji stále neindexuje – robots.txt je prvním podezřelým, kterého je třeba zkontrolovat.

Při přidání oblastí, které mají být skryty (členské stránky, interní stránky)

Pokud váš web přidává stránky pro správu účtu, členskou oblast nebo interní stránky – aktualizujte robots.txt, abyste tyto oblasti zablokovali.

Při změně platformy webu nebo redesignu

Každá platforma (WordPress, Webflow, vlastní kód) vytváří odlišnou strukturu URL. Při migraci může starý robots.txt nesprávně zablokovat nové stránky nebo vynechat stránky, které je třeba zablokovat.

Když Search Console hlásí chybu "Blocked by robots.txt"

Google Search Console má přehled Indexing, který ukazuje, které stránky jsou blokovány souborem robots.txt. Pokud zjistíte, že důležitá stránka je zablokována – je čas soubor upravit.

5 běžných chyb robots.txt a jejich řešení

Chyba 1: Blokování celého webu – nejzávažnější chyba

Projev: Žádná stránka není společností Google indexována. Search Console hlásí mnoho stránek jako "Blocked by robots.txt".

Příčina: Soubor robots.txt obsahuje:

User-agent: 
Disallow: /

Tyto dva řádky znamenají: "Zakázat všem botům vstup na jakoukoli stránku." Často se stává, když vývojář nastaví toto pravidlo během vývoje na staging serveru a zapomene ho odstranit při spuštění.

Řešení: Upravte na:

User-agent: *
Disallow:

Sitemap: https://ten-mien.com/sitemap.xml

Disallow: (bez ničeho za dvojtečkou) = povolit prohledávání všeho.

⚠️ Toto je chyba číslo 1, kterou vidíme na nových firemních webech. Po opravě může společnosti Google trvat několik dní až týdnů, než stránky znovu projde. Odešlete znovu sitemapu přes Search Console, abyste tento proces urychlili.

Chyba 2: Blokování CSS a JavaScriptu

Projev: Web se v prohlížeči zobrazuje normálně, ale při použití nástroje "URL Inspection" v Search Console Google zjistí, že stránka má rozbité rozložení nebo chybí obsah.

Příčina: Robots.txt blokuje složky obsahující CSS a JS:

Disallow: /wp-content/
Disallow: /wp-includes/

Google potřebuje číst CSS a JS, aby pochopil, jak stránka vypadá (tomu se říká "renderování"). Pokud je blokováno, Google nemůže stránku vykreslit → nerozumí obsahu → ovlivňuje to hodnocení.

Řešení:

User-agent: *
Disallow: /wp-admin/
Allow: /wp-admin/admin-ajax.php
Allow: /wp-content/
Allow: /wp-includes/
📝 Poznámka pro vývojáře: Od roku 2014 Google jasně doporučuje: neblokujte CSS, JS a obrázky v robots.txt. Googlebot potřebuje tyto zdroje k správnému vykreslení stránky. Použijte nástroj URL Inspection v Search Console ke kontrole, jak Google vaši stránku vykresluje.

Chyba 3: Nesprávné zablokování důležitých stránek

Projev: Stránky služeb, produktové stránky nebo blogové příspěvky se nezobrazují ve výsledcích vyhledávání Google – i když jsou v sitemapě uvedeny.

Příčina: Pravidlo v robots.txt je příliš obecné. Například:

Disallow: /dich-vu

Tento řádek blokuje nejen /dich-vu/, ale také /dich-vu-thiet-ke-web/, /dich-vu-seo/ a jakékoli URL začínající na /dich-vu.

Řešení: Přidejte lomítko / na konec cesty, abyste přesně zablokovali složku:

Disallow: /dich-vu-noi-bo/

Nebo použijte Allow k ochraně potřebných stránek:

Disallow: /dich-vu-noi-bo/
Allow: /dich-vu/
Allow: /dich-vu-thiet-ke-web/
📝 Poznámka pro vývojáře: Pořadí `Allow` a `Disallow` má vliv. Googlebot používá nejpřesnější cestu (most specific path). Pokud mají stejnou délku, má `Allow` přednost před `Disallow`. Vždy testujte pomocí nástroje Robots Testing Tool v Search Console před nasazením.

Chyba 4: Chybějící soubor robots.txt

Projevy: Zadáte ten-mien.com/robots.txt → zobrazí se chyba 404.

Příčina: Web je vytvořen ručně a vývojář tento soubor nevytvořil. Nebo byl soubor omylem smazán během nasazení.

Dopad: Není tak závažný jako chyba 1 – pokud neexistuje robots.txt, Google ve výchozím nastavení prochází vše. To však znamená:

  • Google bude procházet i administrační stránky, testovací stránky, interní stránky
  • Nemáte způsob, jak přes robots.txt nasměrovat na sitemapu
  • Chybí základní kontrola

Řešení: Vytvořte soubor robots.txt v kořenovém adresáři. Minimální obsah:

User-agent: *
Disallow: /admin/
Disallow: /search?

Sitemap: https://ten-mien.com/sitemap.xml

Chyba 5: Použití robots.txt k skrytí stránek před Google (špatné pochopení účelu)

Projevy: Blokujete stránku pomocí Disallow, ale tato stránka se stále zobrazuje na Google – i když bez úryvku obsahu.

Příčina: Robots.txt blokuje procházení (crawl), nikoli indexování (index). Pokud byla stránka již dříve indexována, nebo na ni odkazuje zpětný odkaz z jiného webu, Google si může URL v výsledcích vyhledávání ponechat – pouze nebude zobrazovat obsah.

Správné řešení:

CílPoužijte
Nechcete, aby Google procházel (skenoval)Disallow v robots.txt
Nechcete, aby Google indexoval (zobrazoval)Tag v HTML
Nechcete obojíPoužijte noindex v HTML (a neblokujte v robots.txt)
⚠️ Toto je nejčastěji špatně pochopený bod: Pokud současně blokujete procházení (robots.txt) a nastavíte `noindex` (HTML), Google neuvidí tag noindex, protože stránku neprochází — a stránka může být přesto indexována. Řešení: použijte `noindex` v HTML a odstraňte pravidlo `Disallow` pro danou stránku v robots.txt.

Vzor robots.txt pro firemní weby

Zde je vzorový soubor robots.txt vhodný pro většinu malých a středních firemních webů:

# =============================================
# Robots.txt pro firemní web
# Aktualizováno: 2026-04-20
# =============================================

# Platí pro všechny boty
User-agent: *

# Blokovat administrativní a interní sekce
Disallow: /admin/
Disallow: /wp-admin/
Disallow: /dashboard/
Disallow: /staging/

# Blokovat interní vyhledávací stránky (abyste neplýtvali crawl budget)
Disallow: /search?
Disallow: /*?s=

# Blokovat URL s trackingovými parametry (abyste se vyhnuli duplicitnímu obsahu)
Disallow: /*?utm_
Disallow: /*?ref=
Disallow: /*?fbclid=

# Blokovat nákupní košík / platební stránky (pokud existují)
Disallow: /cart/
Disallow: /checkout/
Disallow: /my-account/

# Povolit CSS, JS, obrázky (Google je potřebuje k vykreslení stránky)
Allow: /wp-content/uploads/
Allow: /wp-content/themes/
Allow: /wp-includes/

# Nasměrovat na sitemapu
Sitemap: https://ten-mien.com/sitemap.xml
📝 Poznámka pro vývojáře: Soubor robots.txt musí být umístěn v kořenovém adresáři domény — `https://example.com/robots.txt`. Nikoli `/blog/robots.txt` nebo jinou podadresářovou cestu. Každá subdoména potřebuje vlastní robots.txt (např. `blog.example.com/robots.txt` je oddělené od `example.com/robots.txt`).

Jak zkontrolovat robots.txt vašeho webu

Metoda 1: Přímá kontrola v prohlížeči

Zadejte https://ten-mien-cua-ban.com/robots.txt do adresního řádku. Uvidíte obsah souboru ve formátu textu. Pokud se zobrazí chyba 404 — web ještě nemá robots.txt.

Metoda 2: Použití Google Search Console

  1. Přihlaste se do Google Search Console
  2. Přejděte do sekce SettingsCrawlingrobots.txt
  3. Zobrazte soubor robots.txt, který Google čte
  4. Zkontrolujte, zda je konkrétní URL blokována

Metoda 3: Kontrola v reportu Indexing

V Search Console → Pages (nebo Indexing) → Najděte sekci "Blocked by robots.txt". Pokud je v tomto seznamu důležitá stránka, musíte okamžitě opravit robots.txt.

💡 Doporučuje se kontrolovat robots.txt alespoň jednou za čtvrtletí nebo kdykoli dojde k významným změnám na webu (přidání stránek, změna struktury, migrace platformy).

Souhrnná tabulka: Co by měl robots.txt blokovat a co ne

✅ CO BLOKOVAT❌ CO NEBLOKOVAT
Administrační stránky (/admin/, /wp-admin/)Domovská stránka, stránky služeb, kontaktní stránky
Staging / testovací stránkyBlogové články, příspěvky
Interní vyhledávání (/search?)Soubory CSS a JavaScript
URL s parametry pro sledování (?utm_, ?fbclid=)Obrázky (Google Images také přináší návštěvnost)
Nákupní košík, platební stránky, osobní účtySitemap
Stránky s duplicitním obsahem (filtr, řazení, stránkování)Stránky FAQ, případové studie

Často kladené otázky k robots.txt

Jaký je rozdíl mezi robots.txt a sitemap?

Sitemap říká: "Toto jsou stránky, o kterých chci, aby je Google věděl." Robots.txt říká: "Toto jsou stránky, které nechci, aby je Google procházel." Oba soubory se navzájem doplňují — sitemap ukazuje cestu dovnitř, robots.txt staví bariéry.

Pokud nemám robots.txt, může Google procházet web?

Ano. Bez robots.txt Google ve výchozím nastavení prochází všechny stránky — včetně těch, které nechcete. Proto je tento soubor nezbytný.

Používám WordPress, kde najdu robots.txt?

WordPress si virtuální robots.txt vytváří sám. Pokud používáte SEO plugin jako Yoast nebo Rank Math, můžete robots.txt upravovat přímo v pluginu, aniž byste museli přistupovat k serveru.

Ovlivňuje robots.txt rychlost webu?

Ne. Tento soubor má jen pár KB. Nemá vliv na rychlost načítání stránek.

Zablokoval jsem stránku pomocí robots.txt, proč se stále objevuje ve výsledcích Google?

Protože robots.txt blokuje pouze procházení (crawl), nikoli indexaci. Pokud chcete, aby stránka zcela zmizela z Google, použijte tag v HTML — a tuto stránku v robots.txt neblokujte (aby Google mohl přečíst tag noindex).

Jak dlouho trvá, než Google po úpravě robots.txt provede aktualizaci?

Google obvykle kontroluje robots.txt znovu během 24-48 hodin. V Search Console → Settings → Crawling můžete požádat Google o rychlejší kontrolu.

Závěr

Robots.txt je malý soubor — často jen několik řádků — ale přímo ovlivňuje to, zda Google váš web uvidí.

Co si pamatovat:

  1. Robots.txt je cedule "Vstup zakázán": říká Googlu, které stránky nemá procházet
  2. Zkontrolujte hned po spuštění webu: chyba blokující celý web je běžná a nejzávažnější
  3. Nepoužívejte robots.txt k skrytí stránek před Googlem: blokuje procházení, nikoli indexaci
  4. Vždy povolte CSS a JS: Google potřebuje renderovat stránku, aby pochopil obsah
  5. Kombinujte se sitemapou a Search Console: pro plnou kontrolu nad tím, jak Google prochází a indexuje váš web

Zkontrolujte svou webovou platformu

Soubor robots.txt je jen jedním z mnoha technických faktorů ovlivňujících SEO. Pokud si kladete otázku: "Je moje webová stránka správně nastavena?" — odpověď spočívá v platformě, kterou používáte.

GTG CRM vám pomůže vytvořit webové stránky se standardním souborem robots.txt, automatickým sitemapem a technickou strukturou připravenou pro Google — nemusíte se starat o úpravu jednotlivých souborů a řádků kódu.

Proměňte to, co jste si právě přečetli, v reálné výsledky — použijte to hned s GTG CRM, zdarma.

Použít hned