Tutoriels WordPress de confiance, quand vous en avez le plus besoin.
Guide du débutant pour WordPress
WPB Cup
30 Millions+
Sites web utilisant nos plugins
20+
Années d'expérience WordPress
3000+
Tutoriels WordPress par des experts

Comment optimiser votre fichier Robots.txt WordPress pour le SEO

Votre site WordPress possède déjà un fichier robots.txt et il prend des décisions quant à ce que les robots d'exploration des moteurs de recherche peuvent accéder, que vous l'ayez jamais touché ou non.

La plupart de ces décisions sont inoffensives. Mais une seule règle mal choisie peut également empêcher les robots d'exploration d'accéder à des URL que vous souhaitez qu'ils découvrent.

Dans ce guide, nous vous montrerons ce que fait votre fichier robots.txt et comment le modifier sans toucher au code.

Optimisation d'un fichier robots.txt WordPress pour le SEO

Voici tout ce que nous allons couvrir dans ce guide :

Qu'est-ce qu'un fichier robots.txt ?

Robots.txt est un fichier texte brut qui indique aux robots des moteurs de recherche quelles parties de votre site ils peuvent explorer.

Le fichier se trouve dans le répertoire racine (le dossier principal) de votre site web. Le format de base ressemble à ceci :

User-agent: [user-agent name]
Disallow: [URL string not to be crawled]

User-agent: [user-agent name]
Allow: [URL string to be crawled]

Sitemap: [URL of your XML Sitemap]

Vous pouvez ajouter autant de règles et de sitemaps que nécessaire. Si vous ne bloquez pas une URL, les robots supposent qu'ils peuvent l'explorer.

Votre site fonctionne bien sans fichier robots.txt lorsque vous démarrez un blog. Cependant, à mesure que votre contenu grandit, ce fichier devient plus utile.

Les moteurs de recherche attribuent à chaque site web un budget d'exploration, qui est le nombre de pages qu'ils exploreront dans un délai donné. En bloquant les pages non importantes, vous aidez les robots à dépenser ce budget pour le contenu que vous souhaitez voir apparaître dans les résultats de recherche.

Ceci est le plus important pour les grands sites avec des milliers de pages.

Gardez à l'esprit que robots.txt vous aide à contrôler l'exploration, pas l'indexation.

  • L'exploration est le moment où les robots des moteurs de recherche (comme Googlebot) visitent votre site web pour découvrir son contenu.
  • L'indexation est le moment où ils ajoutent ce contenu à leur base de données de recherche massive afin qu'il puisse apparaître dans les résultats de recherche.

Considérez cela comme un bibliothécaire qui lit un nouveau livre (exploration) puis l'ajoute au catalogue de la bibliothèque (indexation).

En d'autres termes, robots.txt n'est pas non plus un bon moyen de cacher du contenu car une page bloquée peut toujours apparaître dans les résultats de recherche si d'autres sites web y font référence. Pour exclure de manière fiable une page de Google, utilisez plutôt une balise méta 'noindex'. Cela indique aux moteurs de recherche de ne pas répertorier la page du tout.

Exemples et meilleures pratiques de Robots.txt

Pour la plupart des sites WordPress, vous pouvez garder votre fichier robots.txt assez simple. Voici la configuration de base que nous recommandons :

User-Agent: *
Allow: /wp-content/uploads/
Allow: /wp-admin/admin-ajax.php
Disallow: /wp-admin/
Disallow: /readme.html
Disallow: /refer/
Disallow: /?s=

Sitemap: https://www.example.com/post-sitemap.xml
Sitemap: https://www.example.com/page-sitemap.xml

Voici ce que fait chaque règle :

  • Allow: /wp-content/uploads/ permet aux moteurs de recherche d'explorer vos images et autres fichiers téléchargés dans votre médiathèque WordPress.
  • Allow: /wp-admin/admin-ajax.php maintient l'accès au gestionnaire AJAX de WordPress. Les thèmes et plugins peuvent utiliser ce fichier pour charger ou mettre à jour du contenu sans rafraîchir la page.
  • Disallow: /wp-admin/ empêche les robots d'accéder à votre zone d'administration WordPress, qui ne contient pas de contenu que vous souhaitez voir apparaître dans les résultats de recherche.
  • Disallow: /readme.html empêche les robots d'accéder au fichier readme.html par défaut de WordPress. Ce fichier n'est pas utile aux moteurs de recherche, il y a donc peu de raisons pour qu'ils l'explorent.
  • Disallow: /refer/ empêche les robots de suivre les URL d'affiliation ou autres URL de redirection qui utilisent le préfixe /refer/. Si votre site utilise un préfixe différent pour ces liens, remplacez /refer/ par le vôtre.
  • Disallow: /?s= empêche les robots de demander les URL de recherche internes de WordPress. Ces pages ne sont généralement pas des pages de destination utiles pour les moteurs de recherche et peuvent créer de nombreuses URL inutiles à explorer.
  • Sitemap indique aux moteurs de recherche où trouver vos sitemaps XML. Cela leur permet de découvrir plus facilement les URL que vous souhaitez qu'ils explorent.

Ce sont les mêmes types de règles fondamentales que nous utilisons sur WPBeginner. Vous pouvez voir notre fichier en direct sur wpbeginner.com/robots.txt. Notre fichier de production contient des règles supplémentaires pour un site beaucoup plus grand, mais les principes de base sont les mêmes.

Gardez à l'esprit que l'utilisation du caractère générique * s'applique à tous les robots d'exploration.

Par exemple, cette règle empêche Googlebot d'explorer le dossier /private/ :

User-agent: Googlebot
Disallow: /private/

Les noms d'agents utilisateurs courants incluent Googlebot (Google), Bingbot (Bing) et Baiduspider (Baidu).

Comment créer un fichier Robots.txt dans WordPress

Il existe deux méthodes pour créer un fichier robots.txt dans WordPress. Vous pouvez choisir celle qui vous convient le mieux.

Méthode 1 : Modifier le fichier Robots.txt avec All in One SEO

La plupart des plugins WordPress SEO gratuits, tels que All in One SEO (AIOSEO), Yoast ou Rank Math, vous permettent de personnaliser votre fichier robots.txt directement depuis votre tableau de bord WordPress.

Nous utilisons AIOSEO sur WPBeginner. La version gratuite d'AIOSEO vous aide à valider votre règle robots.txt au fur et à mesure que vous tapez, ce qui vous permet de détecter les erreurs de syntaxe avant qu'elle ne soit mise en ligne. 

Une fois le plugin actif, allez simplement dans All in One SEO » Outils dans votre tableau de bord WordPress. Vous arriverez sur l'éditeur Robots.txt. Activez le bouton bascule « Activer Robots.txt personnalisé » pour commencer la modification.

Activer le commutateur personnalisé robots.txt

L'éditeur affiche les règles par défaut que WordPress génère lui-même.

Vous pouvez maintenant ajouter vos propres règles. Entrez un agent utilisateur dans le champ « Agent utilisateur », ou utilisez * pour appliquer la règle à tous les robots.

Choisissez ensuite « Autoriser » ou « Interdire » dans la colonne Directive, et tapez le chemin du fichier ou du dossier dans le champ « Valeur ». Pour ajouter une autre règle, cliquez sur le bouton « Ajouter une règle ».

Ajout d'une règle personnalisée dans l'éditeur robots.txt de All in One SEO

Vous pouvez vérifier votre fichier finalisé dans l'aperçu « Aperçu personnalisé de Robots.txt » en bas de l'écran. Il montre le fichier complet exactement comme les robots le verront.

Aperçu robots.txt de All in One SEO

Lorsque vous avez terminé, cliquez sur le bouton « Enregistrer les modifications » pour sauvegarder vos règles.

Méthode 2 : Modifier manuellement le fichier Robots.txt via FTP

Si vous préférez modifier directement votre fichier robots.txt, suivez cette méthode. Pour modifier le fichier, vous devrez utiliser un client FTP ou le gestionnaire de fichiers de votre panneau d'hébergement WordPress.

Avant de modifier quoi que ce soit, téléchargez une copie de sauvegarde de votre fichier robots.txt actuel sur votre ordinateur. Ainsi, vous pourrez le restaurer si quelque chose se passe mal.

Tout d'abord, connectez votre client FTP à votre site web WordPress et trouvez le fichier robots.txt dans le dossier racine de votre site.

Modifier le fichier robots via FTP

Si vous n'en voyez pas, votre site n'a pas encore de fichier robots.txt. Vous pouvez en créer un directement ici.

Robots.txt est un fichier texte brut. Vous pouvez le télécharger, le modifier dans n'importe quel éditeur de texte brut comme le Bloc-notes ou TextEdit, et le téléverser à nouveau dans votre dossier racine.

Comment tester votre fichier Robots.txt

Après avoir créé ou modifié votre fichier robots.txt, vérifiez-le toujours pour détecter les erreurs. Une petite faute de frappe peut bloquer des pages importantes des moteurs de recherche, et vous pourriez ne pas vous en rendre compte pendant des semaines.

Le moyen le plus simple de tester votre fichier robots.txt pour les erreurs est d'utiliser Google Search Console.

D'abord, assurez-vous que votre site est connecté à Google Search Console. S'il ne l'est pas, suivez notre guide sur comment ajouter votre site WordPress à Google Search Console.

Ensuite, allez sur votre tableau de bord Search Console et ouvrez les Paramètres dans le menu en bas à gauche. Trouvez la section « Exploration » et cliquez sur « Ouvrir le rapport » à côté de « robots.txt ».

Ouverture du rapport robots.txt dans les paramètres de la Google Search Console

Cliquez sur la version actuelle du fichier dans la liste. Le rapport affiche le dernier robots.txt que Google a trouvé, et il met en évidence les erreurs de syntaxe ou les problèmes logiques qu'il a détectés.

Le rapport robots.txt de la Google Search Console montrant un fichier valide

Si vous venez de mettre à jour votre fichier et que les modifications n'apparaissent pas, attendez un jour, puis vérifiez à nouveau. 

Questions fréquemment posées sur robots.txt WordPress

Voici les questions les plus fréquentes que nos lecteurs nous posent sur l'optimisation du fichier robots.txt dans WordPress.

1. L'utilisation de robots.txt peut-elle améliorer la sécurité de mon site ?

Non, le fichier robots.txt n’est pas une mesure de sécurité. Le fichier est visible publiquement, il n’empêche donc personne d’accéder aux URL que vous listez. Il fournit simplement des directives aux robots d’exploration des moteurs de recherche bien élevés.

2. Dois-je bloquer les pages de catégories et d'étiquettes de WordPress dans robots.txt ?

Non, vous ne devez pas bloquer les pages de catégories et d'étiquettes. Ces pages d'archives contiennent des liens internes que les robots d'exploration suivent pour atteindre vos anciens articles, donc les bloquer supprime un chemin de découverte pour le contenu que vous souhaitez indexer.

3. Quelle est la différence entre robots.txt et la balise noindex ?

Ils contrôlent des choses différentes. Robots.txt contrôle si un robot d'exploration peut visiter une URL ou non. La balise noindex contrôle si les moteurs de recherche répertorient une page dans les résultats de recherche, même s'ils l'ont déjà visitée.

Utilisez robots.txt pour bloquer les robots d'exploration des zones telles que votre panneau d'administration, votre environnement de staging ou les répertoires de plugins. Utilisez noindex pour les pages que vous acceptez que Google explore, comme les pages d'archives filtrées ou les pages de remerciement, que vous ne souhaitez simplement pas voir apparaître dans les résultats de recherche.

Nous espérons que cet article vous a aidé à apprendre comment optimiser votre fichier robots.txt WordPress pour le SEO. Vous voudrez peut-être également consulter notre guide ultime du SEO WordPress et nos meilleurs choix d'experts pour les meilleurs outils SEO WordPress pour développer votre site Web.

Si vous avez aimé cet article, abonnez-vous à notre Chaîne YouTube pour des tutoriels vidéo WordPress. Vous pouvez également nous trouver sur Twitter et Facebook.

Divulgation : Notre contenu est soutenu par nos lecteurs. Cela signifie que si vous cliquez sur certains de nos liens, nous pouvons gagner une commission. Consultez comment WPBeginner est financé, pourquoi c'est important et comment vous pouvez nous soutenir. Voici notre processus éditorial.

La boîte à outils WordPress ultime

Accédez GRATUITEMENT à notre boîte à outils - une collection de produits et de ressources liés à WordPress que tout professionnel devrait posséder !

Interactions des lecteurs

133 CommentairesLaisser une réponse

    • Pour un multisite, vous auriez besoin d'un fichier robots.txt dans le dossier racine de chaque site.

      Admin

  1. Mon site wordpress est nouveau et mon robot.txt par défaut est
    user-agent: *
    Disallow: /wp-admin/
    Allow: /wp-admin/admin-ajax.php

    Je veux que Google explore et indexe mon contenu. Est-ce que ce robot.txt est correct ?

  2. Super article…

    J'étais confus depuis tant de jours à propos du fichier Robots.txt et des liens Disallow. J'ai copié les balises pour le fichier robots. J'espère que cela résoudra le problème de mon site

  3. Les fichiers dans les captures d'écran de votre dossier personnel se trouvent en fait dans le dossier public_html sous mon dossier personnel.

    Je n'avais pas de dossier /refer sous mon dossier public_html.

    Je n'avais pas de fichiers xml de publication ou de page nulle part sur mon compte WP.

    J'ai inclus une entrée dans le fichier robots.txt que j'ai créé pour interdire l'exploration de mon site sandbox. Je ne suis pas sûr que ce soit nécessaire puisque j'ai déjà sélectionné l'option dans WP indiquant aux robots de ne pas explorer mon site sandbox, mais je ne pense pas que cela nuise d'avoir l'entrée.

    • Certains hôtes renomment public_html en home, c'est pourquoi vous le voyez là. Vous voudrez vous assurer que Yoast est actif pour que les fichiers XML soient disponibles. La méthode de cet article est une précaution supplémentaire pour aider à empêcher l'exploration de votre site :)

      Admin

  4. User-agent: *
    Disallow: /wp-admin/
    Allow: /wp-admin/admin-ajax.php <– C'est mon code robot.txt mais je suis confus pourquoi mon /wp-admin est indexé ? Comment ne pas l'indexer ?

    • S'il a été indexé précédemment, vous devrez peut-être laisser le temps à la mémoire cache du moteur de recherche de se vider

      Admin

  5. Ce site web m'inspire vraiment à commencer un blog. Merci beaucoup à l'équipe. Ce site web, chaque article est riche en informations et explications. Quand j'ai un problème, je visite d'abord ce blog. Merci

  6. J'essaie d'optimiser les robots pour mon site web en utilisant Yoast. Cependant, les outils dans Yoast n'ont pas l'option « Éditeur de fichiers ». Il n'y a que deux options (i) Importer et exporter (ii) Éditeur en masse. Pouvez-vous s'il vous plaît me conseiller sur la façon de résoudre ce problème. Est-ce que je suis sur une édition gratuite de Yoast ?

    • La version gratuite de Yoast a toujours l'option, votre installation peut interdire la modification de fichiers auquel cas vous auriez probablement besoin d'utiliser la méthode FTP.

      Admin

  7. Je trouve cet article vraiment utile car je ne sais pas grand-chose sur le fonctionnement de robot.txt mais maintenant je le sais.

    S'il vous plaît, ce que je ne comprends pas, c'est comment trouver le meilleur format de robot.txt à utiliser sur mon site (je veux dire un qui fonctionne généralement) ?

    J'ai remarqué que de nombreux grands blogs que je consulte et qui se classent bien dans les moteurs de recherche utilisent différents formats de robot.txt...

    Je serais ravi de voir une réponse de votre part ou de quiconque peut aider.

    • Avoir un sitemap et autoriser les zones qui doivent être autorisées est la partie la plus importante. La partie interdire variera en fonction de chaque site. Nous avons partagé un exemple dans notre article de blog, et cela devrait convenir à la plupart des sites WordPress.

      Admin

    • Salut Emmanuel,

      Veuillez consulter la section concernant le fichier robots.txt idéal. Cela dépend de vos propres exigences. La plupart des blogueurs excluent les dossiers d'administration et de plugins WordPress du crawl.

      Admin

      • Merci beaucoup.

        maintenant je comprends. Je suppose que je vais commencer avec le format général pour l'instant.

  8. Article bien écrit, je recommande aux utilisateurs de faire un sitemap avant de créer et d'activer leur texte ROBOTS, cela aidera votre site à être exploré plus rapidement et indexé facilement.

    Jack

  9. Je reçois continuellement le message d'erreur ci-dessous sur Google Webmaster. Je suis bloqué. Quelques points qui n'étaient pas clairs pour moi dans ce tutoriel sont : où trouver les fichiers racine de mon site, comment déterminer si j'ai déjà un fichier « robots.txt » et comment le modifier ?

    • Bonjour Cherisa,

      Le dossier racine de votre site est celui qui contient des dossiers comme wp-admin, wp-includes, wp-content, etc. Il contient également des fichiers comme wp-config.php, wp-cron.php, wp-blogheader.php, etc.

      Si vous ne voyez pas de fichier robots.txt dans ce dossier, alors vous n'en avez pas. Vous pouvez y aller et en créer un nouveau.

      Admin

      • Merci pour votre réponse. J'ai cherché partout et je n'arrive pas à trouver ces fichiers racines comme vous le décrivez. Y a-t-il un répertoire de chemin que je peux suivre pour accéder à ce dossier. Comme s'il se trouve sous Paramètres, etc. ?

  10. J'ai eu un trafic web décent sur mon site web. Il a soudainement chuté à zéro au mois de mai. Jusqu'à présent, je rencontre le problème. S'il vous plaît, aidez-moi à récupérer mon site web.

  11. Bonjour, merci pour cette information, mais j'ai une question.
    J'ai créé le fichier sitemap.xml et robots.txt, et il est bien exploré. Mais comment puis-je créer "Product-Sitemap.xml" ?
    Il y a toute la liste des produits dans le fichier sitemap.xml. Dois-je créer Product-sitemap.xml séparément ?

    et le soumettre à nouveau à Google ou Bing ?
    Pouvez-vous m'aider s'il vous plaît...
    Merci

  12. J'ai un problème avec le réglage du fichier robots.txt. Un seul robots.txt s'affiche pour tous les sites web. S'il vous plaît, aidez-moi à afficher un fichier robots.txt séparé pour tous les sites web. J'ai tous les fichiers robots.txt séparés pour chaque site web individuel. Mais un seul fichier robots.txt s'affiche dans le navigateur pour tous les sites web.

  13. Veuillez expliquer pourquoi vous avez inclus
    Disallow: /refer/
    dans l'exemple de Robots.txt pour débutants ? Je ne comprends pas les implications de cette ligne. Est-ce important pour un débutant ? Vous avez expliqué les deux autres lignes refusées.

    Merci.

  14. Comment puis-je mettre toutes les balises/mondomaine.Com en nofollow ? Dans robots.txt pour concentrer le jus de lien ? Merci.

  15. salut,, j'ai une erreur dans yoast seo concernant le plan du site.. une fois que je clique sur corriger,,, ça revient encore.. le html de mon site ne se charge pas correctement

  16. Je viens de consulter mon compte Google Webmaster Tools et en utilisant la Search Console, j'ai trouvé ce qui suit :
    Page partiellement chargée
    Toutes les ressources de la page n'ont pas pu être chargées. Cela peut affecter la façon dont Google voit et comprend votre page. Corrigez les problèmes de disponibilité pour toutes les ressources qui peuvent affecter la façon dont Google comprend votre page.

    C'est parce que toutes les feuilles de style CSS associées aux plugins sont interdites par le fichier robots.txt par défaut.

    Je comprends les bonnes raisons pour lesquelles je ne devrais pas simplement autoriser cela, mais quelle serait une alternative car je suspecterais que les algorithmes de Google pénalisent le site parce qu'ils ne les voient pas.

  17. Bonjour,

    Lorsque je recherche mon site sur Google, ce texte apparaît sous le lien : « Une description de ce résultat n'est pas disponible en raison du fichier robots.txt de ce site »

    Comment puis-je résoudre ce problème ?

    Cordialement

    • Salut Suren,

      Il semble que quelqu'un ait accidentellement modifié les paramètres de confidentialité de votre site. Allez dans Paramètres » Page Lecture et faites défiler jusqu'à la section « Visibilité pour les moteurs de recherche ». Assurez-vous que la case à côté de est décochée.

      Admin

  18. Bonjour

    Comme je l'ai vu dans l'outil pour les webmasters, j'ai un fichier robot.txt comme suit :

    User-agent: *
    Disallow: /wp-admin/
    Allow: /wp-admin/admin-ajax.php

    Dites-moi si c'est correct ? Ou dois-je utiliser autre chose ?

  19. Je voudrais savoir s'il est judicieux de bloquer (interdire) « /wp-content/plugins/ » dans robots.tx ? Chaque fois que je supprime un plugin, une erreur 404 s'affiche sur certaines pages de ce plugin.

  20. J'ai adoré cette explication. En tant que débutant, j'étais très confus au sujet du fichier robot.txt et de ses utilisations. Mais maintenant, je sais quel est son but.

  21. dans certains fichiers robot.txt, index.php a été interdit. Pouvez-vous expliquer pourquoi ? est-ce une bonne pratique.

  22. Pouvez-vous me dire pourquoi cela se produit dans l'outil pour les webmasters :

    Réseau inaccessible : robots.txt inaccessibleNous n'avons pas pu explorer votre sitemap car nous avons trouvé un fichier robots.txt à la racine de votre site mais nous n'avons pas pu le télécharger. Veuillez vous assurer qu'il est accessible ou supprimez-le complètement.

    le fichier robots.txt existe mais toujours

  23. Mise à jour intéressante de l'équipe Yoast à ce sujet sur

    Citation : « Les anciennes bonnes pratiques consistant à avoir un robots.txt qui bloque l'accès à votre répertoire wp-includes et à votre répertoire de plugins ne sont plus valides. »

  24. Autoriser : /wp-content/uploads/

    Ne devrait-ce pas être ?
    Disallow: /wp-content/uploads/

    Parce que vous êtes conscient que Google indexera toutes vos pages de téléchargement en tant qu'URL publiques, n'est-ce pas ? Et ensuite, vous recevrez des erreurs pour la page elle-même. Y a-t-il quelque chose que je manque ici ?

    • Dans l'ensemble, ce sont les pages réelles que Google explore pour générer des cartes d'images, PAS les dossiers de téléchargement. Ensuite, vous auriez un problème avec toutes les petites tailles d'images et d'autres images destinées à l'interface utilisateur qui seraient également indexées.

      Cela semble être la meilleure option :
      Disallow: /wp-content/uploads/

      Si je me trompe, veuillez m'expliquer cela afin que je puisse comprendre votre point de vue.

    • Très probablement, votre hébergeur permet d'accéder à votre site avec des URL www et non-www. Essayez de modifier robots.txt à l'aide d'un client FTP. Examinez-le ensuite à partir des deux URL si vous pouvez voir vos modifications sur les deux URL, cela signifie que c'est le même fichier.

      Admin

      • Merci pour la réponse rapide. Je l'ai déjà fait, mais je ne vois aucun changement. Y a-t-il un autre moyen de résoudre ce problème ?

  25. Le billet de blog de Yoast sur ce sujet était juste au-dessus du vôtre dans ma recherche, alors bien sûr, j'ai consulté les deux. Ils se contredisent un peu. Par exemple, Yoast a dit que le fait de ne pas autoriser les répertoires de plugins et autres pourrait gêner les robots d'exploration de Google lors de la récupération de votre site, car les plugins peuvent générer du CSS ou du JS. Il a également mentionné (et d'après ma propre expérience), que Yoast n'ajoute rien lié au sitemap au robots.txt, mais le génère de telle sorte que vous puissiez l'ajouter à votre console de recherche. Voici le lien vers son article, peut-être pourrez-vous vérifier à nouveau car il est très difficile de choisir à qui se fier ;)

  26. Comme je ne suis pas doué pour créer ce fichier Robotstxt, puis-je utiliser votre fichier Robots.txt en modifiant les paramètres comme l'URL et le sitemap de mon site, est-ce bien ? ou devrais-je en créer un différent

  27. Bonjour,
    Aujourd'hui, j'ai reçu cet e-mail de Google : « Googlebot ne peut pas accéder aux fichiers CSS et JS »… quelle peut être la solution ?

    Merci

    • Laissez-moi deviner… Vous utilisez des services CDN pour importer des fichiers CSS et JS.
      ou
      Il est possible que vous ayez écrit une syntaxe incorrecte dans ces fichiers.

  28. J'ai une question sur l'ajout de sitemaps. Comment puis-je ajouter les sitemaps Yahoo et Bing au fichier Robots et au répertoire WordPress ?

  29. Merci pour le plan détaillé de l'utilisation du fichier robots.txt. Quelqu'un sait-il si Yahoo utilise également ce robots.txt, et s'il respecte les règles mentionnées dans le fichier ? Je pose cette question car j'ai un « Disallow » pour une certaine page dans mon fichier, mais je reçois du trafic venant de Yahoo sur cette page. Rien de Google, comme il se doit. Merci d'avance.

  30. correction…

    « Si vous utilisez le plugin Yoast’s WordPress SEO ou un autre plugin pour générer votre sitemap XML, alors votre plugin essaiera d'ajouter automatiquement les lignes relatives à votre sitemap dans le fichier robots.txt. »

    Pas vrai. WordPress SEO n'ajoute pas le sitemap au robots.txt

    « J'ai toujours pensé que lier votre sitemap XML depuis votre robots.txt était un peu absurde. Vous devriez les ajouter manuellement à vos Google et Bing Webmaster Tools et vous assurer de consulter leurs commentaires sur votre sitemap XML. C'est la raison pour laquelle notre plugin WordPress SEO ne l'ajoute pas à votre robots.txt. »

    https://yoast.com/wordpress-robots-txt-example/

    Il est également plus recommandé de ne pas interdire le répertoire wp-plugins (voir les raisons dans l'article de Yoast)

    Et personnellement, j'aime simplement supprimer le fichier readme.txt...

    ;-)

  31. J'ai compris le fichier robots.txt et son utilisation. Qu'est-ce que le sitemap et comment puis-je créer un sitemap pour mon site ?

  32. Après avoir lu la documentation de Google, j'ai l'impression que la directive à utiliser dans le fichier robots.txt est disallow, qui indique seulement aux bots ce qu'ils peuvent et ne peuvent pas explorer. Cela ne leur dit pas ce qui peut et ne peut pas être indexé. Vous devez utiliser la balise meta robots noindex pour qu'une page ne soit pas indexée.

  33. article vraiment bon pour un fichier robots.txt optimisé pour le SEO. Mais j'ai besoin que vous donniez un tutoriel sur la façon de téléverser un fichier robots.txt sur un serveur. En tant que débutant, cela semble être un problème majeur de téléverser ce fichier.
    Au fait, merci d'avoir partagé des informations si bénéfiques.
    -Nitin

  34. Quelle est la meilleure façon d'ajouter du code à HTTacess pour bloquer plusieurs referrers de bots spam pour leur URL et leur adresse IP s'il n'y a pas d'URL donnée ?

    Je sais que si vous avez une syntaxe incorrecte lors de la modification de httacess, cela peut mettre votre site hors ligne. Je suis un débutant et j'ai besoin de bloquer ces multiples URL ennuyeuses de Russie, de Chine, d'Ukraine, etc.

    Merci beaucoup

  35. pourquoi faut-il ajouter Allow: !!!
    si je mentionne seulement ce qui doit être Disallow, c'est suffisant. Je n'ai pas besoin d'écrire de code pour Allow car Googlebot ou Bingbot exploreront automatiquement tout le reste.
    Alors pourquoi devrais-je utiliser à nouveau Allow ?

  36. Puisque l'absence du fichier Robots.txt n'empêche pas le site d'être exploré, je suis curieux : existe-t-il des données concrètes sur la façon dont la présence du fichier améliore les performances SEO ?

    J'ai fait une recherche rapide sur Google et je n'ai pas trouvé de données quantitatives à ce sujet. Il y a environ un demi-million d'articles disant : « Hé, cela améliore le SEO ! », mais j'aimerais vraiment savoir de quoi nous parlons ici, même de manière générale.

    Est-ce une amélioration de 5 % ? 50 ? 500 ?

    • Les moteurs de recherche ne partagent pas de telles données. Bien que l'absence d'un fichier robots.txt n'empêche pas les moteurs de recherche d'explorer ou d'indexer un site web. Cependant, c'est une bonne pratique recommandée.

      Admin

  37. Bon timing pour cela. J'essayais de trouver cette information hier.

    La raison pour laquelle je la cherchais est que les outils Google Webmaster me disaient qu'ils ne pouvaient pas explorer correctement mon site car je bloquais diverses ressources nécessaires au bon rendu de la page.

    Ces ressources comprenaient celles trouvées dans /wp-content/plugins/

    Après avoir autorisé ce dossier, l'avertissement a disparu.

    Des idées à ce sujet ?

    • Vous pouvez ignorer ces avertissements en toute sécurité. Ce n'est qu'un avertissement si vous aviez réellement du contenu que vous souhaiteriez indexer. Parfois, les utilisateurs ont restreint les robots de recherche et l'ont oublié. Ces avertissements sont utiles dans ces situations.

      Admin

  38. J'ai une question : beaucoup de gens utilisent un sitemap statique, et vous savez qu'ils ont un site WordPress. Devrions-nous utiliser un sitemap statique ou un sitemap généré par WordPress ?

  39. Sympa, j'aime la façon dont Wpbeginner le fait, et avec ce classement Alexa, cela me semble être la meilleure façon d'utiliser robots.txt...

  40. Que signifie mon fichier robots.txt s'il ressemble à ceci ?

    User-agent: *
    Disallow: /wp-admin/
    Disallow: /wp-includes/
    Disallow: /xmlrpc.php

    • Cela indique simplement que les moteurs de recherche ne doivent pas indexer votre dossier wp-admin, votre dossier wp-includes et le fichier xml-rpc. Parfois, interdire /wp-includes/ peut bloquer certains scripts pour les moteurs de recherche, surtout si votre site utilise ces scripts. Cela peut nuire à votre SEO.

      La meilleure chose à faire est d'aller sur Google Webmaster Tools et de récupérer votre site web en tant que bot. Si tout se charge correctement, vous n'avez rien à craindre. S'il indique que des scripts sont bloqués, vous voudrez peut-être supprimer la ligne wp-includes.

      Admin

      • Je ne vois aucune logique dans votre idée d'avoir un script dans le répertoire includes qui puisse être utilisé par un robot d'exploration / robot... et d'autre part, s'il y a un cas isolé, il est préférable après avoir spécifié le défaut WordPress autorise ce fichier que vous imaginez que les moteurs de recherche utilisent ses scripts ! après tout, WordPress n'a certainement pas par défaut un robots.txt anti-moteurs de recherche !!!!

Laisser un commentaire

Merci d'avoir choisi de laisser un commentaire. N'oubliez pas que tous les commentaires sont modérés conformément à notre politique de commentaires, et votre adresse e-mail ne sera PAS publiée. N'utilisez PAS de mots-clés dans le champ nom. Ayons une conversation personnelle et significative.