CrawlerControl
Produktleitfaden

So funktioniert es

Überprüfen Sie, welche URLs jeder Bot crawlen kann, finden Sie die genaue Regel heraus, die über den Zugriff entscheidet, und laden Sie vor der Veröffentlichung eine korrigierte robots.txt herunter.

Methode

  1. 01

    Trennt Benutzer-Agent-Gruppen und Zulassen/Nicht-Zulassen-Regeln.

  2. 02

    Wählen Sie die spezifischste Gruppe aus und wenden Sie die Übereinstimmung mit dem längsten Pfad an.

  3. 03

    Zeigt die Gewinnregel, Warnungen und eine herunterladbare normalisierte robots.txt-Datei an.

Ihre Angaben

Fügen Sie Ihre robots.txt ein und probieren Sie eine Route aus

Annahmen bearbeiten und Ergebnis sofort prüfen.

Inhalt von robots.txt
Fügen Sie keine Geheimnisse ein; robots.txt ist öffentlich.
lokale Route
Es wird keine Netzwerkanfrage gestellt.
Benutzeragent
Die Aufzeichnung ist bewusst kurz und versioniert gehalten.

Ergebnis

Zugang, gewinnende Herrschaft und Konflikte

Das Szenario wurde mit den sichtbaren Daten neu berechnet. Überprüfen Sie die Metriken, Details und Grenzwerte, bevor Sie das Ergebnis verwenden oder herunterladen.

  • Benutzeragent getestet
  • lokale Route
  • Gewinnregel
  • Konflikte

Verantwortungsvoller Umfang

Quellen und Umfang

robots.txt ist kein Authentifizierungs-, Sicherheits- oder Deindexierungsbefehl. Der Simulator implementiert eine praktische Teilmenge von RFC 9309 und fragt keine Remote-URLs ab.

Tool ausprobieren