Accueil › Robots.txt

Qu'est-ce que le fichier robots.txt ?

Le fichier qui indique aux robots quelles parties de votre site ils peuvent explorer : ce qu'il permet, ce qu'il ne permet pas, et les erreurs qui coûtent cher.

Discuter avec un expert Starboost
Fichier robots.txt : règles d'exploration d'un site pour les robots, Starboost

Qu'est-ce que le fichier robots.txt, en une phrase ?

Le robots.txt est un fichier texte placé à la racine d'un site, à l'adresse /robots.txt, qui indique aux robots d'exploration comme Googlebot quelles URL ils peuvent ou ne peuvent pas explorer. Il contrôle l'exploration, pas l'indexation.

Agence
Starboost, 40 rue du Colisée, 75008 Paris — intervient dans toute la France
Avis clients
5/5 sur 136 avis Google
Résultats
+235 clients accompagnés, +7 M€ de chiffre d'affaires généré
Certifications
Google Partner Premium, Meta Business Partner

Comment fonctionne le fichier robots.txt

Il applique le protocole d'exclusion des robots, désormais normalisé. Un fichier s'applique à un hôte donné et se lit à la racine du site. Ses règles s'organisent en groupes : User-agent désigne le robot concerné, Disallow liste les chemins à ne pas explorer, Allow prévoit des exceptions et Sitemap indique l'adresse du plan de site. Google comprend aussi les caractères jokers * et $. Un exemple minimal :

User-agent: *
Disallow: /panier/
Sitemap: https://www.exemple.fr/sitemap.xml

Exploration et indexation : la confusion classique

Bloquer une URL dans le robots.txt empêche son exploration, mais pas forcément son apparition dans les résultats : si d'autres pages pointent vers elle, Google peut l'indexer sans en connaître le contenu. Pour qu'une page n'apparaisse pas, il faut une directive noindex (balise meta robots ou en-tête HTTP), et la page doit rester explorable pour que Google puisse lire cette directive. Quant à un contenu confidentiel, le robots.txt est inadapté : le fichier est public, et seule une protection par mot de passe convient.

Ce qu'il faut bloquer, et ce qu'il faut laisser

  • À bloquer en général : paniers, espaces de compte, résultats de recherche interne, paramètres d'URL sans valeur, environnements de test.
  • À ne pas bloquer : les pages à indexer, ainsi que les fichiers CSS et JavaScript nécessaires à l'affichage de la page, que Google doit pouvoir charger pour la comprendre.

Un exemple concret

Un site dont le moteur de recherche interne génère des milliers d'URL de résultats peut interdire ce dossier d'exploration. Le robot consacre alors son temps aux pages utiles, et le fichier déclare l'adresse du sitemap pour lui indiquer où elles se trouvent.

Où le trouver et comment le tester

Le fichier doit répondre en code 200 à l'adresse racine, et chaque sous-domaine a le sien. Ouvrez-le dans votre navigateur, puis consultez le rapport robots.txt de la Search Console, qui indique la version récupérée par Google et les erreurs de syntaxe. Après chaque modification, testez quelques URL stratégiques : une règle trop large peut retirer des sections entières de l'exploration.

Les robots d'IA

Des directives dédiées existent pour plusieurs robots d'IA, par exemple GPTBot (OpenAI), ClaudeBot (Anthropic), PerplexityBot, ou le jeton Google-Extended qui encadre certains usages de vos contenus par les IA de Google. Les autoriser ou les bloquer est un choix stratégique : bloquer peut limiter votre présence dans leurs réponses, autoriser permet d'être lu. Ce choix se fait selon vos objectifs, au cas par cas.

Les erreurs les plus fréquentes

  • Laisser Disallow: / après une mise en ligne, hérité de l'environnement de test.
  • Bloquer les fichiers CSS et JavaScript.
  • Confondre Disallow et noindex.
  • Oublier la ligne Sitemap, ou se tromper de casse dans un chemin, car les chemins distinguent les majuscules des minuscules.
  • Laisser le fichier en erreur serveur : une erreur 404 revient à tout autoriser, alors qu'une erreur 5xx persistante peut suspendre l'exploration.

Le robots.txt reste un outil sensible : une seule ligne mal placée peut retirer tout un site de l'exploration. Toute modification doit donc être testée avant la mise en ligne, relue par une seconde personne et suivie les jours suivants dans la Search Console.

Comment Starboost le traite

Nous relisons le robots.txt à chaque audit technique, nous vérifions son état dans la Search Console et nous contrôlons sa cohérence avec le sitemap XML et les directives noindex. Il fait partie de notre travail de SEO technique, notamment quand il s'agit d'optimiser le budget de crawl.

Starboost applique ça pour ses clients

Chez Starboost, nous relisons votre robots.txt ligne par ligne, nous le comparons à la structure réelle du site et nous corrigeons ce qui bloque ou gaspille l'exploration, sans toucher à ce qui fonctionne.

Découvrir notre SEO technique Réserver mon audit gratuit

Ce que disent nos clients

+136 avis Google 5 étoiles

★★★★★

Je suis très satisfaite des services de Starboost, un vrai suivi dans tous les aspects pour améliorer l'entreprise, leur expertise a considérablement amélioré ma visibilité en ligne. Les résultats en un mois seulement, je recommande à 100%

Sirine Rached
★★★★★

Nous avons récemment souscris à un abonnement pour le référencement local et nous sommes ravis de l'expérience ! Le responsable est sérieux réactif et bienveillant. Je recommande leur service de seo local.

Lisa
★★★★★

Une agence marketing digital qui m'a accompagné, conseillé sur le SEO local, merci pour la gentillesse et l'efficacité

Charlotte Blin
★★★★★

Très professionnel, bon relationnel, réactif et à l'écoute du client. Je recommande à 100%

Arlocc
★★★★★

Tres professionnel service de qualité et très à l'écoute. J'ai fait la commande d'une carte ainsi que d'un présentoir afin de gagner en visibilité. Je recommande vivement.

Merwan Rekik
★★★★★

Merci pour vos services ! Mon présentoir m'a augmentée fortement mes avis sur Google. Je vous recommande fortement. Équipe très sympa et réactive !

Reda Lakkis
★★★★★

Travail soigné, je recommande

Pixapub
★★★★★

Très professionnel. Ravi du résultat. Merci.

Edouard Ruol
Expertises connexes

Nous accompagnons aussi votre écosystème

Questions fréquentes

Pas de façon fiable. Il empêche l'exploration d'une URL, mais Google peut tout de même l'indexer, sans contenu, si d'autres pages pointent vers elle. Pour exclure une page des résultats, utilisez la directive noindex et laissez la page accessible aux robots.

Si le fichier est introuvable (erreur 404), les robots considèrent qu'aucune restriction n'est posée et explorent tout ce qu'ils peuvent. Ce n'est pas une erreur en soi, mais le fichier reste utile pour déclarer le sitemap et écarter les zones sans valeur.

Ce travail s'inscrit dans notre offre de SEO technique. Nos accompagnements démarrent à 490 €/mois, avec un suivi mensuel de vos résultats. L'audit initial est gratuit et dure 30 minutes : il définit le périmètre exact des actions à mener.

Oui. Starboost est basée au 40 rue du Colisée, 75008 Paris, et accompagne des établissements dans toute la France, ainsi qu'en Belgique, en Suisse et à Monaco. L'agence publie 107 pages locales couvrant les principales villes françaises, de Paris à Cherbourg.

Plus de 235 établissements accompagnés et plus de 7 M€ de chiffre d'affaires généré, pour une note de 5/5 sur 136 avis Google. Les résultats détaillés sont publiés en études de cas chiffrées : positions gagnées, appels générés, visibilité obtenue.