CrawlerControl
Productgids

Hoe het werkt

Controleer welke URL's elke bot kan crawlen, ontdek de exacte regel die de toegang bepaalt en download een gecorrigeerde robots.txt voordat u deze publiceert.

Methode

  1. 01

    Scheidt user-agentgroepen en regels voor toestaan/niet toestaan.

  2. 02

    Selecteer de meest specifieke groep en pas de langste padmatch toe.

  3. 03

    Toont de winnende regel, waarschuwingen en een downloadbare, genormaliseerde robots.txt.

Jouw input

Plak je robots.txt en probeer een route

Bewerk aannames en bekijk het resultaat onmiddellijk.

Inhoud van robots.txt
Plak geen geheimen; robots.txt is openbaar.
lokale route
Er is geen netwerkverzoek gedaan.
User-agent
De plaat is opzettelijk kort en voorzien van een versie.

Resultaat

Toegang, winnende heerschappij en conflicten

Het scenario is herberekend met de zichtbare gegevens. Controleer de statistieken, details en limieten voordat u het resultaat gebruikt of downloadt.

  • User-agent getest
  • lokale route
  • Winnende regel
  • Conflicten

Verantwoord bereik

Bronnen en reikwijdte

robots.txt is geen authenticatie-, beveiligings- of deindexeringsopdracht. De simulator implementeert een praktische subset van RFC 9309 en vraagt ​​geen externe URL's op.

Probeer het hulpmiddel