CrawlerControl
Przewodnik po produkcie

Jak to działa

Sprawdź, które adresy URL może indeksować każdy bot, poznaj dokładną regułę decydującą o dostępie i pobierz poprawiony plik robots.txt przed publikacją.

Metoda

  1. 01

    Oddziela grupy agentów użytkownika i reguły Zezwalaj/Zabraniaj.

  2. 02

    Wybierz najbardziej konkretną grupę i zastosuj dopasowanie najdłuższej ścieżki.

  3. 03

    Wyświetla zwycięską regułę, ostrzeżenia i znormalizowany plik robots.txt do pobrania.

Twoje dane

Wklej plik robots.txt i wypróbuj trasę

Edytuj założenia i od razu sprawdź wynik.

Zawartość pliku robots.txt
Nie wklejaj tajemnic; plik robots.txt jest publiczny.
trasa lokalna
Nie wykonano żadnego żądania sieciowego.
Agent użytkownika
Zapis jest celowo krótki i wersjonowany.

Wynik

Dostęp, zwycięska reguła i konflikty

Scenariusz został przeliczony na podstawie widocznych danych. Przed użyciem lub pobraniem wyniku przejrzyj metryki, szczegóły i limity.

  • Przetestowano agenta użytkownika
  • trasa lokalna
  • Zwycięska zasada
  • Konflikty

Odpowiedzialny zakres

Źródła i zakres

plik robots.txt nie jest poleceniem uwierzytelniania, zabezpieczeń ani deindeksowania. Symulator implementuje praktyczny podzbiór RFC 9309 i nie wysyła zapytań do zdalnych adresów URL.

Wypróbuj narzędzie