CrawlerControl
Guide du produit

Fonctionnement

Vérifiez quelles URL chaque robot peut explorer, découvrez la règle exacte qui décide de l'accès et téléchargez un fichier robots.txt corrigé avant de le publier.

Méthode

  1. 01

    Sépare les groupes d'agents utilisateurs et les règles d'autorisation/interdiction.

  2. 02

    Sélectionnez le groupe le plus spécifique et appliquez la correspondance de chemin la plus longue.

  3. 03

    Affiche la règle gagnante, les avertissements et un fichier robots.txt normalisé téléchargeable.

Vos données

Collez votre robots.txt et essayez un itinéraire

Modifiez les hypothèses et vérifiez immédiatement le résultat.

Contenu du fichier robots.txt
Ne collez pas de secrets ; robots.txt est public.
itinéraire local
Aucune demande de réseau n'est effectuée.
Agent utilisateur
Le disque est volontairement court et versionné.

Résultat

Accès, règle gagnante et conflits

Le scénario a été recalculé avec les données visibles. Examinez les mesures, les détails et les limites avant d’utiliser ou de télécharger le résultat.

  • Agent utilisateur testé
  • itinéraire local
  • Règle gagnante
  • Conflits

Portée responsable

Sources et portée

robots.txt n'est pas une commande d'authentification, de sécurité ou de désindexation. Le simulateur implémente un sous-ensemble pratique de la RFC 9309 et n'interroge pas les URL distantes.

Essayer l’outil