Czym jest plik robots.txt?
Plik robots.txt to prosty plik tekstowy umieszczony w głównym katalogu strony internetowej. Jego zadaniem jest poinformowanie robotów wyszukiwarek, które części witryny mogą indeksować, a które powinny pominąć.
Plik jest częścią standardu Robots Exclusion Protocol (REP) — zestawu wytycznych regulujących, jak roboty przeszukują, indeksują i przetwarzają strony internetowe. Co ważne, robots.txt to jeden z pierwszych plików, które roboty wyszukiwarek odwiedzają podczas skanowania strony — zanim dotrą do jakiejkolwiek podstrony.
Jak działa robots.txt — instrukcje dla robotów wyszukiwarek
Plik wskazuje, które części strony mogą być przeszukiwane przez roboty, a które nie. Właściciele stron mogą go używać do blokowania dostępu do określonych stron lub sekcji — na przykład stron z wewnętrznymi danymi firmy lub stron w trakcie budowy.
Składnia: User-agent i Disallow
Plik zawiera dwa podstawowe elementy:
▸ User-agent — identyfikuje robota, którego dotyczą instrukcje. Gwiazdka (*) oznacza, że zasady dotyczą wszystkich robotów wyszukiwarek.
▸ Disallow — wskazuje, które strony lub katalogi są zablokowane dla robotów.
Przykładowy plik robots.txt
User-agent: *
Disallow: /private/
Disallow: /tmp/
W tym przykładzie wszystkie roboty wyszukiwarek mają zablokowany dostęp do katalogów /private/ i /tmp/.
Inny typowy przykład konfiguracji:
User-agent: *
Disallow: /admin/
Disallow: /login/
Tutaj roboty omijają katalogi /admin/ i /login/.
Zastosowanie pliku robots.txt w praktyce
Plik robots.txt jest szczególnie przydatny, gdy chcesz ograniczyć dostęp do określonych części witryny. Typowe przypadki użycia:
▸ Blokowanie stron o niskiej wartości — stron logowania, koszyka czy stron w trakcie budowy.
▸ Zapobieganie duplikacji treści — blokowanie dostępu do stron z podobną zawartością, co chroni przed potencjalnymi problemami w wynikach wyszukiwania.
▸ Blokowanie plików administracyjnych i katalogów z danymi użytkowników — treści, które nie powinny być indeksowane.
Jak skonfigurować robots.txt dla SEO?
Poprawnie skonfigurowany plik robots.txt może znacznie poprawić wyniki SEO strony. Pozwala skupić roboty wyszukiwarek na najważniejszych podstronach, poprawia szybkość ich indeksowania i pomaga uniknąć duplikacji treści.
Plik umieszcza się w głównym katalogu strony internetowej. Każda reguła składa się z pary: User-agent (dla kogo) i Disallow (co blokujemy). Jeśli chcesz zablokować konkretny katalog dla wszystkich robotów, wystarczy:
User-agent: *
Disallow: /nazwa-katalogu/
Jeśli chcesz, żeby dany robot miał dostęp do całej witryny, wystarczy pozostawić Disallow puste lub nie dodawać go wcale.
Podsumowanie
Plik robots.txt to narzędzie, które pozwala kontrolować, jak roboty wyszukiwarek przeszukują i indeksują strony internetowej. Poprzez blokowanie nieistotnych lub wrażliwych sekcji witryny, można skupić uwagę robotów na najważniejszych podstronach — co przekłada się na lepszą widoczność w wynikach wyszukiwania.
To pojęcie jest częścią Słownika SEO — zbioru 244 definicji z pozycjonowania i marketingu internetowego. Zobacz wszystkie →

