Какво е Robots.txt и кога фирмите трябва да му обърнат внимание?

Имате sitemap, подали сте го на Google, уебсайтът ви започва да се индексира. Но един ден откривате, че административният панел, вътрешните страници за плащане или staging версията на уебсайта се появяват в Google. Клиентите въвеждат името на компанията – и виждат незавършена тестова страница.

Или обратното: публикувате нова статия в блога, чакате две седмици и все още не се появява в Google. Питате техническия екип, те казват: „Файлът robots.txt блокира Google да обхожда целия уебсайт.“

И двата сценария са свързани с малък файл, който малко уеб администратори забелязват: robots.txt.

Тази статия ще обясни какво е robots.txt, как работи, кога трябва да го редактирате и какви често срещани грешки трябва да избягвате – всичко това с прости думи и реални примери.

Какво е robots.txt? Обяснение за уеб администратори

Ако sitemap е карта на сградата – казва на Google кои стаи има, то robots.txt е табела „Зона с ограничен достъп“ – казва на Google кои стаи не трябва да се посещават.

Технически казано: robots.txt е малък текстов файл, разположен в основната директория на уебсайта (например: https://example.com/robots.txt). Този файл съдържа правила, които казват на ботовете на търсачките – като Googlebot – какво:

  • Може да бъде обхождано (сканирано)
  • Не може да бъде обхождано (сканирано)
  • Къде се намира sitemap

Можете да видите robots.txt на всеки уебсайт, като въведете: domain-name.com/robots.txt в браузъра си.

💡 Важно: robots.txt е само учтива молба, а не абсолютно забрана. Реномирани ботове като Googlebot ще я спазват, но злонамерени ботове (спам, скрейпъри) могат да я игнорират. Ако се нуждаете от истинска сигурност, използвайте пароли или защитна стена – не разчитайте на robots.txt.

Как изглежда файлът robots.txt?

Не е нужно да пишете този файл от нулата. Но за да разберете, когато го видите, ето един прост файл robots.txt:

User-agent: *
Disallow: /admin/
Disallow: /thanh-toan/
Disallow: /staging/
Allow: /

Sitemap: https://example.com/sitemap.xml

Обяснение ред по ред:

РедЗначение
User-agent: *Прилага се за всички ботове (Google, Bing и т.н.)
Disallow: /admin/Не позволява на ботовете да влизат в директорията /admin/
Disallow: /thanh-toan/Не позволява на ботовете да влизат в страниците за плащане
Disallow: /staging/Не позволява на ботовете да влизат в staging версията
Allow: /Позволява на ботовете да обхождат всичката останала част
Sitemap: https://...Казва на ботовете къде се намира sitemap

Ето един по-сложен пример – подходящ за бизнес уебсайт с блог, страници за услуги и административна зона:

# Позволява на всички ботове да обхождат публично съдържание
User-agent: *
Disallow: /admin/
Disallow: /wp-admin/
Disallow: /cart/
Disallow: /checkout/
Disallow: /my-account/
Disallow: /search?
Disallow: /*?ref=
Disallow: /*?utm_

# Позволява на Googlebot да обхожда CSS и JS (необходими за визуализация на страницата)
User-agent: Googlebot
Allow: /wp-content/uploads/
Allow: /wp-includes/

Sitemap: https://example.com/sitemap.xml

📝 Забележка за разработчици: Символът в пътя е wildcard – /*?utm_ означава блокиране на всеки URL, съдържащ параметър ?utm_. Символът $ в края на пътя се използва за точно съвпадение в края на URL. Например: Disallow: /*.pdf$ ще блокира всички PDF файлове.

---

Как robots.txt работи в SEO процеса?

За да разберете мястото на robots.txt, нека погледнем процеса, чрез който Google добавя уебсайтове в резултатите от търсенето:

Crawl → Index → Rank
(Обхождане) (Индексиране) (Класиране)

Robots.txt работи на първата стъпка – Crawl.

Преди Googlebot да започне да сканира някоя страница на вашия уебсайт, той първо проверява robots.txt. Ако даден URL е посочен в Disallow, Googlebot ще игнорира тази страница – няма да я сканира, няма да чете съдържанието ѝ.

Googlebot иска да обходи https://example.com/admin/settings
→ Проверява robots.txt
→ Вижда Disallow: /admin/
→ Игнорира, не обхожда

Googlebot иска да обходи https://example.com/dich-vu/
→ Проверява robots.txt
→ Не е блокиран
→ Обхожда нормално → Индексира → Може да се появи в резултатите от търсенето

Robots.txt и sitemap: подкрепяща двойка

ФайлРоля
Sitemap„Това е списък с страниците, които искам Google да знае.“
Robots.txt„Това са страниците, които не искам Google да обхожда.“

Двата файла не си противоречат – работят заедно. Sitemap показва пътя, robots.txt поставя бариери. Комбинирани правилно, вие контролирате какво Google вижда и какво игнорира на вашия уебсайт.

За какво се използва robots.txt? 4 често срещани случая

1. Скриване на административни и вътрешни страници от Google

Административни страници, бекенд страници на CMS, staging страници, тестови страници – всичко това не трябва да се появява в Google. Robots.txt ви помага да кажете на Google: „Не влизай тук.“

Disallow: /admin/
Disallow: /wp-admin/
Disallow: /staging/

2. Избягване на загуба на „crawl budget“

Google не обхожда безкрайно. Всеки уебсайт има „crawl budget“ – брой страници, които Googlebot ще сканира при всяко посещение. Ако уебсайтът има много неважни страници (страници за вътрешно търсене, страници за филтриране, страници за пагинация), Googlebot може да е зает с тяхното сканиране вместо със сканирането на важни страници за услуги или блог постове.

Disallow: /search?
Disallow: /tag/
Disallow: /page/

💡 Crawl budget е предимно важен за големи уебсайтове (хиляди страници). Малките бизнес уебсайтове обикновено не се нуждаят от твърде много притеснения, но поддържането на чист robots.txt е добро упражнение.

3. Блокиране на дублирано съдържание

Ако уебсайтът има множество URL адреси, водещи до едно и също съдържание (например URL с проследяващ параметър ?utm_source=facebook или версия за печат ?print=true), можете да блокирате тези дублирани URL адреси:

Disallow: /*?utm_
Disallow: /*?ref=
Disallow: /*?print=

4. Посочване на sitemap

Robots.txt е първото място, което Googlebot проверява, когато достигне уебсайта. Поставянето на пътя към sitemap тук помага на Google да намери sitemap по-бързо – дори ако все още не сте го подали през Search Console.

Sitemap: https://example.com/sitemap.xml

Кога фирмите трябва да обърнат внимание на robots.txt?

Не винаги се налага да редактирате robots.txt. Но има моменти, когато проверката на този файл е задължителна:

При стартиране на уебсайта (go-live)

Това е най-важният момент. Много уебсайтове биват напълно блокирани за обхождане, защото разработчиците забравят да премахнат реда Disallow: / – ред, който са поставили по време на staging, за да не индексира Google незавършената версия.

Проверка при go-live:

КатегорияМетод на проверка
Файлът robots.txt съществуваОтворете https://domain-name.com/robots.txt в браузъра си
Не блокира целия уебсайтУверете се, че НЯМА ред Disallow: /
Има декларация за sitemapУверете се, че ИМА ред Sitemap: https://domain-name.com/sitemap.xml
Важни страници не са блокираниПроверете дали страниците за услуги, блог, контакти не са в Disallow

✅ Когато уебсайтът не се индексира от Google след няколко седмици

Ако имате sitemap, сте го подали през Search Console, но Google все още не го индексира – robots.txt е първият заподозрян, който трябва да проверите.

При добавяне на зони, които трябва да бъдат скрити (страници за членове, вътрешни страници)

Ако уебсайтът добавя страници за управление на акаунти, зони за членове или вътрешни страници – актуализирайте robots.txt, за да блокирате тези зони.

При смяна на платформата на уебсайта или редизайн

Всяка платформа (WordPress, Webflow, custom code) създава различна структура на URL. При миграция, старият robots.txt може погрешно да блокира нови страници или да пропусне блокирането на такива, които трябва да бъдат скрити.

Когато Search Console съобщи за грешка „Blocked by robots.txt“

Google Search Console има отчет Indexing, който показва кои страници са блокирани от robots.txt. Ако видите, че важна страница е блокирана – време е да редактирате файла незабавно.

5 често срещани грешки в robots.txt и как да ги поправите

Грешка 1: Блокиране на целия уебсайт – най-сериозната грешка

Симптоми: Никоя страница не се индексира от Google. Search Console съобщава за многобройни страници „Blocked by robots.txt“.

Причина: Файлът robots.txt съдържа:

User-agent: 
Disallow: /

Тези два реда означават: „Забранява се на всички ботове да влизат на която и да е страница.“ Това обикновено се случва, когато разработчик постави този правило по време на staging и забрави да го премахне при go-live.

Решение: Редактирайте на:

User-agent: *
Disallow:

Sitemap: https://domain-name.com/sitemap.xml

Disallow: (без нищо след двоеточието) = позволява обхождане на всичко.

⚠️ Това е грешка №1, която виждаме при нови бизнес уебсайтове. След като я поправите, Google може да отнеме няколко дни до няколко седмици, за да обходи отново. Подайте отново sitemap през Search Console, за да ускорите процеса.

---

Грешка 2: Блокиране на CSS и JavaScript

Симптоми: Уебсайтът се показва нормално в браузъра, но когато използвате инструмента „URL Inspection“ в Search Console, Google вижда, че страницата има счупен дизайн или е празна.

Причина: Robots.txt блокира директориите, съдържащи CSS и JS:

Disallow: /wp-content/
Disallow: /wp-includes/

Google трябва да чете CSS и JS, за да разбере как изглежда страницата (т.нар. „rendering“). Ако са блокирани, Google не може да рендерира страницата → не разбира съдържанието → влияе на класирането.

Решение:

User-agent: *
Disallow: /wp-admin/
Allow: /wp-admin/admin-ajax.php
Allow: /wp-content/
Allow: /wp-includes/

📝 Забележка за разработчици: От 2014 г. Google препоръчва изрично: не блокирайте CSS, JS и изображения в robots.txt. Googlebot се нуждае от тези ресурси, за да рендерира страницата правилно. Използвайте инструмента URL Inspection в Search Console, за да проверите как Google рендерира вашата страница.

Грешка 3: Погрешно блокиране на важна страница

Симптоми: Страници за услуги, страници за продукти или блог постове не се появяват в Google – въпреки че sitemap ги изброява.

Причина: Правилото в robots.txt е твърде общо. Например:

Disallow: /dich-vu

Този ред блокира не само /dich-vu/, но и /dich-vu-thiet-ke-web/, /dich-vu-seo/ и всеки URL, започващ с /dich-vu.

Решение: Добавете наклонена черта / в края на пътя, за да блокирате точно директорията:

Disallow: /dich-vu-noi-bo/

Или използвайте Allow, за да защитите необходимата страница:

Disallow: /dich-vu-noi-bo/
Allow: /dich-vu/
Allow: /dich-vu-thiet-ke-web/

📝 Забележка за разработчици: Редът на Allow и Disallow има значение. Googlebot използва най-специфичното правило (most specific path). Ако са с еднаква дължина, Allow има предимство пред Disallow. Винаги тествайте с Robots Testing Tool в Search Console преди внедряване.

Грешка 4: Липса на файл robots.txt

Симптоми: Въвеждате domain-name.com/robots.txt → получавате грешка 404.

Причина: Уебсайтът е създаден ръчно и разработчикът не е създал този файл. Или файлът е бил изтрит погрешно при внедряване.

Влияние: Не толкова сериозно, колкото грешка 1 – ако няма robots.txt, Google по подразбиране обхожда всичко. Но това означава:

  • Google ще обхожда административни страници, тестови страници, вътрешни страници
  • Нямате начин да посочите пътя към sitemap чрез robots.txt
  • Липсва основен контрол

Решение: Създайте файл robots.txt в основната директория. Минимално съдържание:

User-agent: *
Disallow: /admin/
Disallow: /search?

Sitemap: https://domain-name.com/sitemap.xml

---

Грешка 5: Използване на robots.txt за скриване на страници от Google (неправилно разбиране на целта)

Симптоми: Блокирате страница с Disallow, но страницата все още се появява в Google – макар и без фрагмент от съдържание.

Причина: Robots.txt блокира обхождане, а не индексиране. Ако страницата вече е била индексирана преди това, или има беклинкове от други уебсайтове, сочещи към нея, Google може да запази URL адреса в резултатите от търсене – просто няма да показва съдържание.

Правилно решение:

ЦелКакво да използвате
Не искате Google да обхожда (сканира)Disallow в robots.txt
Не искате Google да индексира (показва)Таг <meta name="robots" content="noindex"> в HTML
Не искате нито едното, нито друготоИзползвайте noindex в HTML (и не блокирайте в robots.txt)

⚠️ Това е най-често срещаното погрешно разбиране: Ако едновременно блокирате обхождане (robots.txt) и поставите noindex (HTML), Google няма да види тага noindex, защото няма да обходи страницата – и страницата може да бъде индексирана. Решение: използвайте noindex в HTML и премахнете правилото Disallow за тази страница в robots.txt.

Примерен robots.txt за бизнес уебсайт

Ето примерен файл robots.txt, подходящ за повечето малки и средни бизнес уебсайтове:

# =============================================
# Robots.txt за бизнес уебсайт
# Актуализирано: 2026-04-20
# =============================================

# Прилага се за всички ботове
User-agent: *

# Блокиране на административни и вътрешни зони
Disallow: /admin/
Disallow: /wp-admin/
Disallow: /dashboard/
Disallow: /staging/

# Блокиране на страници за вътрешно търсене (за избягване на загуба на crawl budget)
Disallow: /search?
Disallow: /*?s=

# Блокиране на URL адреси с проследяващи параметри (за избягване на дублирано съдържание)
Disallow: /*?utm_
Disallow: /*?ref=
Disallow: /*?fbclid=

# Блокиране на кошница / плащане (ако има такива)
Disallow: /cart/
Disallow: /checkout/
Disallow: /my-account/

# Позволяване на CSS, JS, изображения (Google ги нуждае, за да рендерира страницата)
Allow: /wp-content/uploads/
Allow: /wp-content/themes/
Allow: /wp-includes/

# Посочване на sitemap
Sitemap: https://domain-name.com/sitemap.xml

📝 Забележка за разработчици: Файлът robots.txt трябва да бъде разположен в основния домейн – https://example.com/robots.txt. Не в /blog/robots.txt или друга поддиректория. Всеки поддомейн се нуждае от собствен robots.txt (например blog.example.com/robots.txt е отделен от example.com/robots.txt).

Как да проверите robots.txt на вашия уебсайт

Начин 1: Проверка директно в браузъра

Въведете https://your-domain-name.com/robots.txt в адресната лента. Ще видите съдържанието на файла като текст. Ако получите грешка 404 – уебсайтът няма robots.txt.

Начин 2: Използване на Google Search Console

  1. Влезте в Google Search Console
  2. Отидете в SettingsCrawlingrobots.txt
  3. Прегледайте файла robots.txt, който Google чете
  4. Проверете дали даден URL е блокиран

Начин 3: Проверка в отчета за индексиране

В Search Console → Pages (или Indexing) → Намерете секцията „Blocked by robots.txt“. Ако има важни страници в този списък, трябва незабавно да коригирате robots.txt.

💡 Препоръчително е да проверявате robots.txt поне веднъж на тримесечие или всеки път, когато има големи промени в уебсайта (добавяне на страници, промяна на структурата, миграция на платформа).

Обобщена таблица: Какво трябва и какво не трябва да блокира robots.txt

✅ ТРЯБВА да блокира❌ НЕ ТРЯБВА да блокира
Административни страници (/admin/, /wp-admin/)Начална страница, страници за услуги, страница за контакти
Staging / тестови странициБлог постове, статии
Страници за вътрешно търсене (/search?)CSS и JavaScript файлове
URL адреси с проследяващи параметри (?utm_, ?fbclid=)Изображения (Google Images също носи трафик)
Страници за кошница, плащане, личен акаунтSitemap
Страници с дублирано съдържание (филтри, сортиране, пагинация)Страници с ЧЗВ, казуси

---

Често задавани въпроси относно robots.txt

Каква е разликата между robots.txt и sitemap?

Sitemap казва: „Това са страниците, за които искам Google да знае.“ Robots.txt казва: „Това са страниците, които не искам Google да обхожда.“ Двата файла се допълват – sitemap посочва пътя навътре, robots.txt поставя бариерите.

Ако няма robots.txt, ще може ли Google да обхожда уебсайта?

Да. Без robots.txt, Google по подразбиране обхожда всички страници – включително тези, които не искате. Затова е добре да имате този файл.

Използвам WordPress, къде се намира robots.txt?

WordPress създава виртуален robots.txt. Ако използвате SEO плъгин като Yoast или Rank Math, можете да редактирате robots.txt директно в плъгина, без да имате достъп до сървъра.

Robots.txt влияе ли на скоростта на уебсайта?

Не. Файлът е само няколко KB. Той не влияе на скоростта на зареждане на страницата.

Блокирах страница чрез robots.txt, защо тя все още се появява в Google?

Защото robots.txt блокира обхождане, а не индексиране. Ако искате страницата напълно да изчезне от Google, използвайте таг <meta name="robots" content="noindex"> в HTML – и не блокирайте страницата в robots.txt (за да може Google да прочете noindex тага).

Колко време отнема на Google да актуализира robots.txt след редакция?

Google обикновено проверява отново robots.txt в рамките на 24-48 часа. Можете да отидете в Search Console → Settings → Crawling, за да поискате от Google да провери отново по-рано.

Заключение

Robots.txt е малък файл – обикновено само няколко реда – но пряко влияе на това дали Google ще види вашия уебсайт.

Неща, които трябва да запомните:

  1. Robots.txt е табела „Зона с ограничен достъп“: казва на Google кои страници да не обхожда
  2. Проверете веднага при стартиране на уебсайта: грешката за блокиране на целия уебсайт е най-честата и най-сериозната
  3. Не използвайте robots.txt за скриване на страници от Google: той блокира обхождане, а не индексиране
  4. Винаги позволявайте CSS и JS: Google се нуждае от тях, за да рендерира страницата
  5. Комбинирайте със sitemap и Search Console: за пълен контрол върху това какво Google обхожда и индексира на вашия уебсайт

Проверете платформата на вашия уебсайт

Robots.txt е само един от многото технически фактори, влияещи на SEO. Ако се чудите: „Правилно ли са конфигурирани настройките на моя уебсайт?“ – отговорът се крие в платформата, която използвате.

GTG CRM ви помага да имате уебсайт със стандартен robots.txt, автоматичен sitemap и техническа структура, готова за Google – не е нужно да се притеснявате за редактиране на всеки файл, всеки ред код.

Превърнете току-що прочетеното в реални резултати – приложете го сега с GTG CRM, безплатно.

Приложете сега