Votre site WordPress possède déjà un fichier robots.txt et il prend des décisions quant à ce que les robots d'exploration des moteurs de recherche peuvent accéder, que vous l'ayez jamais touché ou non.
La plupart de ces décisions sont inoffensives. Mais une seule règle mal choisie peut également empêcher les robots d'exploration d'accéder à des URL que vous souhaitez qu'ils découvrent.
Dans ce guide, nous vous montrerons ce que fait votre fichier robots.txt et comment le modifier sans toucher au code.

Voici tout ce que nous allons couvrir dans ce guide :
Qu'est-ce qu'un fichier robots.txt ?
Robots.txt est un fichier texte brut qui indique aux robots des moteurs de recherche quelles parties de votre site ils peuvent explorer.
Le fichier se trouve dans le répertoire racine (le dossier principal) de votre site web. Le format de base ressemble à ceci :
User-agent: [user-agent name]
Disallow: [URL string not to be crawled]
User-agent: [user-agent name]
Allow: [URL string to be crawled]
Sitemap: [URL of your XML Sitemap]
Vous pouvez ajouter autant de règles et de sitemaps que nécessaire. Si vous ne bloquez pas une URL, les robots supposent qu'ils peuvent l'explorer.
Votre site fonctionne bien sans fichier robots.txt lorsque vous démarrez un blog. Cependant, à mesure que votre contenu grandit, ce fichier devient plus utile.
Les moteurs de recherche attribuent à chaque site web un budget d'exploration, qui est le nombre de pages qu'ils exploreront dans un délai donné. En bloquant les pages non importantes, vous aidez les robots à dépenser ce budget pour le contenu que vous souhaitez voir apparaître dans les résultats de recherche.
Ceci est le plus important pour les grands sites avec des milliers de pages.
Gardez à l'esprit que robots.txt vous aide à contrôler l'exploration, pas l'indexation.
- L'exploration est le moment où les robots des moteurs de recherche (comme Googlebot) visitent votre site web pour découvrir son contenu.
- L'indexation est le moment où ils ajoutent ce contenu à leur base de données de recherche massive afin qu'il puisse apparaître dans les résultats de recherche.
Considérez cela comme un bibliothécaire qui lit un nouveau livre (exploration) puis l'ajoute au catalogue de la bibliothèque (indexation).
En d'autres termes, robots.txt n'est pas non plus un bon moyen de cacher du contenu car une page bloquée peut toujours apparaître dans les résultats de recherche si d'autres sites web y font référence. Pour exclure de manière fiable une page de Google, utilisez plutôt une balise méta 'noindex'. Cela indique aux moteurs de recherche de ne pas répertorier la page du tout.
Exemples et meilleures pratiques de Robots.txt
Pour la plupart des sites WordPress, vous pouvez garder votre fichier robots.txt assez simple. Voici la configuration de base que nous recommandons :
User-Agent: *
Allow: /wp-content/uploads/
Allow: /wp-admin/admin-ajax.php
Disallow: /wp-admin/
Disallow: /readme.html
Disallow: /refer/
Disallow: /?s=
Sitemap: https://www.example.com/post-sitemap.xml
Sitemap: https://www.example.com/page-sitemap.xml
Voici ce que fait chaque règle :
Allow: /wp-content/uploads/permet aux moteurs de recherche d'explorer vos images et autres fichiers téléchargés dans votre médiathèque WordPress.Allow: /wp-admin/admin-ajax.phpmaintient l'accès au gestionnaire AJAX de WordPress. Les thèmes et plugins peuvent utiliser ce fichier pour charger ou mettre à jour du contenu sans rafraîchir la page.Disallow: /wp-admin/empêche les robots d'accéder à votre zone d'administration WordPress, qui ne contient pas de contenu que vous souhaitez voir apparaître dans les résultats de recherche.Disallow: /readme.htmlempêche les robots d'accéder au fichierreadme.htmlpar défaut de WordPress. Ce fichier n'est pas utile aux moteurs de recherche, il y a donc peu de raisons pour qu'ils l'explorent.Disallow: /refer/empêche les robots de suivre les URL d'affiliation ou autres URL de redirection qui utilisent le préfixe/refer/. Si votre site utilise un préfixe différent pour ces liens, remplacez/refer/par le vôtre.Disallow: /?s=empêche les robots de demander les URL de recherche internes de WordPress. Ces pages ne sont généralement pas des pages de destination utiles pour les moteurs de recherche et peuvent créer de nombreuses URL inutiles à explorer.Sitemapindique aux moteurs de recherche où trouver vos sitemaps XML. Cela leur permet de découvrir plus facilement les URL que vous souhaitez qu'ils explorent.
Ce sont les mêmes types de règles fondamentales que nous utilisons sur WPBeginner. Vous pouvez voir notre fichier en direct sur wpbeginner.com/robots.txt. Notre fichier de production contient des règles supplémentaires pour un site beaucoup plus grand, mais les principes de base sont les mêmes.
Gardez à l'esprit que l'utilisation du caractère générique * s'applique à tous les robots d'exploration.
Par exemple, cette règle empêche Googlebot d'explorer le dossier /private/ :
User-agent: Googlebot
Disallow: /private/
Les noms d'agents utilisateurs courants incluent Googlebot (Google), Bingbot (Bing) et Baiduspider (Baidu).
Comment créer un fichier Robots.txt dans WordPress
Il existe deux méthodes pour créer un fichier robots.txt dans WordPress. Vous pouvez choisir celle qui vous convient le mieux.
Méthode 1 : Modifier le fichier Robots.txt avec All in One SEO
La plupart des plugins WordPress SEO gratuits, tels que All in One SEO (AIOSEO), Yoast ou Rank Math, vous permettent de personnaliser votre fichier robots.txt directement depuis votre tableau de bord WordPress.
Nous utilisons AIOSEO sur WPBeginner. La version gratuite d'AIOSEO vous aide à valider votre règle robots.txt au fur et à mesure que vous tapez, ce qui vous permet de détecter les erreurs de syntaxe avant qu'elle ne soit mise en ligne.
Une fois le plugin actif, allez simplement dans All in One SEO » Outils dans votre tableau de bord WordPress. Vous arriverez sur l'éditeur Robots.txt. Activez le bouton bascule « Activer Robots.txt personnalisé » pour commencer la modification.

L'éditeur affiche les règles par défaut que WordPress génère lui-même.
Vous pouvez maintenant ajouter vos propres règles. Entrez un agent utilisateur dans le champ « Agent utilisateur », ou utilisez * pour appliquer la règle à tous les robots.
Choisissez ensuite « Autoriser » ou « Interdire » dans la colonne Directive, et tapez le chemin du fichier ou du dossier dans le champ « Valeur ». Pour ajouter une autre règle, cliquez sur le bouton « Ajouter une règle ».

Vous pouvez vérifier votre fichier finalisé dans l'aperçu « Aperçu personnalisé de Robots.txt » en bas de l'écran. Il montre le fichier complet exactement comme les robots le verront.

Lorsque vous avez terminé, cliquez sur le bouton « Enregistrer les modifications » pour sauvegarder vos règles.
Méthode 2 : Modifier manuellement le fichier Robots.txt via FTP
Si vous préférez modifier directement votre fichier robots.txt, suivez cette méthode. Pour modifier le fichier, vous devrez utiliser un client FTP ou le gestionnaire de fichiers de votre panneau d'hébergement WordPress.
Avant de modifier quoi que ce soit, téléchargez une copie de sauvegarde de votre fichier robots.txt actuel sur votre ordinateur. Ainsi, vous pourrez le restaurer si quelque chose se passe mal.
Tout d'abord, connectez votre client FTP à votre site web WordPress et trouvez le fichier robots.txt dans le dossier racine de votre site.

Si vous n'en voyez pas, votre site n'a pas encore de fichier robots.txt. Vous pouvez en créer un directement ici.
Robots.txt est un fichier texte brut. Vous pouvez le télécharger, le modifier dans n'importe quel éditeur de texte brut comme le Bloc-notes ou TextEdit, et le téléverser à nouveau dans votre dossier racine.
Comment tester votre fichier Robots.txt
Après avoir créé ou modifié votre fichier robots.txt, vérifiez-le toujours pour détecter les erreurs. Une petite faute de frappe peut bloquer des pages importantes des moteurs de recherche, et vous pourriez ne pas vous en rendre compte pendant des semaines.
Le moyen le plus simple de tester votre fichier robots.txt pour les erreurs est d'utiliser Google Search Console.
D'abord, assurez-vous que votre site est connecté à Google Search Console. S'il ne l'est pas, suivez notre guide sur comment ajouter votre site WordPress à Google Search Console.
Ensuite, allez sur votre tableau de bord Search Console et ouvrez les Paramètres dans le menu en bas à gauche. Trouvez la section « Exploration » et cliquez sur « Ouvrir le rapport » à côté de « robots.txt ».

Cliquez sur la version actuelle du fichier dans la liste. Le rapport affiche le dernier robots.txt que Google a trouvé, et il met en évidence les erreurs de syntaxe ou les problèmes logiques qu'il a détectés.

Si vous venez de mettre à jour votre fichier et que les modifications n'apparaissent pas, attendez un jour, puis vérifiez à nouveau.
Questions fréquemment posées sur robots.txt WordPress
Voici les questions les plus fréquentes que nos lecteurs nous posent sur l'optimisation du fichier robots.txt dans WordPress.
1. L'utilisation de robots.txt peut-elle améliorer la sécurité de mon site ?
Non, le fichier robots.txt n’est pas une mesure de sécurité. Le fichier est visible publiquement, il n’empêche donc personne d’accéder aux URL que vous listez. Il fournit simplement des directives aux robots d’exploration des moteurs de recherche bien élevés.
2. Dois-je bloquer les pages de catégories et d'étiquettes de WordPress dans robots.txt ?
Non, vous ne devez pas bloquer les pages de catégories et d'étiquettes. Ces pages d'archives contiennent des liens internes que les robots d'exploration suivent pour atteindre vos anciens articles, donc les bloquer supprime un chemin de découverte pour le contenu que vous souhaitez indexer.
3. Quelle est la différence entre robots.txt et la balise noindex ?
Ils contrôlent des choses différentes. Robots.txt contrôle si un robot d'exploration peut visiter une URL ou non. La balise noindex contrôle si les moteurs de recherche répertorient une page dans les résultats de recherche, même s'ils l'ont déjà visitée.
Utilisez robots.txt pour bloquer les robots d'exploration des zones telles que votre panneau d'administration, votre environnement de staging ou les répertoires de plugins. Utilisez noindex pour les pages que vous acceptez que Google explore, comme les pages d'archives filtrées ou les pages de remerciement, que vous ne souhaitez simplement pas voir apparaître dans les résultats de recherche.
Nous espérons que cet article vous a aidé à apprendre comment optimiser votre fichier robots.txt WordPress pour le SEO. Vous voudrez peut-être également consulter notre guide ultime du SEO WordPress et nos meilleurs choix d'experts pour les meilleurs outils SEO WordPress pour développer votre site Web.
Si vous avez aimé cet article, abonnez-vous à notre Chaîne YouTube pour des tutoriels vidéo WordPress. Vous pouvez également nous trouver sur Twitter et Facebook.


Steve
Merci pour cela – comment cela fonctionne-t-il sur un WP Multisite cependant ?
Support WPBeginner
Pour un multisite, vous auriez besoin d'un fichier robots.txt dans le dossier racine de chaque site.
Admin
Pacifique Ndanyuzwe
Mon site wordpress est nouveau et mon robot.txt par défaut est
user-agent: *
Disallow: /wp-admin/
Allow: /wp-admin/admin-ajax.php
Je veux que Google explore et indexe mon contenu. Est-ce que ce robot.txt est correct ?
Support WPBeginner
Vous pouvez certainement l'utiliser si vous le souhaitez
Admin
Ritesh Seth
Super article…
J'étais confus depuis tant de jours à propos du fichier Robots.txt et des liens Disallow. J'ai copié les balises pour le fichier robots. J'espère que cela résoudra le problème de mon site
Support WPBeginner
Nous espérons que notre article vous aidera également
Admin
Kurt
Les fichiers dans les captures d'écran de votre dossier personnel se trouvent en fait dans le dossier public_html sous mon dossier personnel.
Je n'avais pas de dossier /refer sous mon dossier public_html.
Je n'avais pas de fichiers xml de publication ou de page nulle part sur mon compte WP.
J'ai inclus une entrée dans le fichier robots.txt que j'ai créé pour interdire l'exploration de mon site sandbox. Je ne suis pas sûr que ce soit nécessaire puisque j'ai déjà sélectionné l'option dans WP indiquant aux robots de ne pas explorer mon site sandbox, mais je ne pense pas que cela nuise d'avoir l'entrée.
Support WPBeginner
Certains hôtes renomment public_html en home, c'est pourquoi vous le voyez là. Vous voudrez vous assurer que Yoast est actif pour que les fichiers XML soient disponibles. La méthode de cet article est une précaution supplémentaire pour aider à empêcher l'exploration de votre site
Admin
Ahmed
Super article
Support WPBeginner
Merci
Admin
ASHOK KUMAR JADON
Bonjour, quel bel article vous avez résolu mon problème. Alors merci beaucoup
Support WPBeginner
Nous sommes heureux que notre article ait pu aider
Admin
Elyn Ashton
User-agent: *
Disallow: /wp-admin/
Allow: /wp-admin/admin-ajax.php <– C'est mon code robot.txt mais je suis confus pourquoi mon /wp-admin est indexé ? Comment ne pas l'indexer ?
Support WPBeginner
S'il a été indexé précédemment, vous devrez peut-être laisser le temps à la mémoire cache du moteur de recherche de se vider
Admin
Ashish kumar
Ce site web m'inspire vraiment à commencer un blog. Merci beaucoup à l'équipe. Ce site web, chaque article est riche en informations et explications. Quand j'ai un problème, je visite d'abord ce blog. Merci
Support WPBeginner
Heureux que nos articles puissent être utiles
Admin
Anna
J'essaie d'optimiser les robots pour mon site web en utilisant Yoast. Cependant, les outils dans Yoast n'ont pas l'option « Éditeur de fichiers ». Il n'y a que deux options (i) Importer et exporter (ii) Éditeur en masse. Pouvez-vous s'il vous plaît me conseiller sur la façon de résoudre ce problème. Est-ce que je suis sur une édition gratuite de Yoast ?
Support WPBeginner
La version gratuite de Yoast a toujours l'option, votre installation peut interdire la modification de fichiers auquel cas vous auriez probablement besoin d'utiliser la méthode FTP.
Admin
Emmanuel Husseni
Je trouve cet article vraiment utile car je ne sais pas grand-chose sur le fonctionnement de robot.txt mais maintenant je le sais.
S'il vous plaît, ce que je ne comprends pas, c'est comment trouver le meilleur format de robot.txt à utiliser sur mon site (je veux dire un qui fonctionne généralement) ?
J'ai remarqué que de nombreux grands blogs que je consulte et qui se classent bien dans les moteurs de recherche utilisent différents formats de robot.txt...
Je serais ravi de voir une réponse de votre part ou de quiconque peut aider.
Personnel éditorial
Avoir un sitemap et autoriser les zones qui doivent être autorisées est la partie la plus importante. La partie interdire variera en fonction de chaque site. Nous avons partagé un exemple dans notre article de blog, et cela devrait convenir à la plupart des sites WordPress.
Admin
Support WPBeginner
Salut Emmanuel,
Veuillez consulter la section concernant le fichier robots.txt idéal. Cela dépend de vos propres exigences. La plupart des blogueurs excluent les dossiers d'administration et de plugins WordPress du crawl.
Admin
Emmanuel Husseni
Merci beaucoup.
maintenant je comprends. Je suppose que je vais commencer avec le format général pour l'instant.
jack
Article bien écrit, je recommande aux utilisateurs de faire un sitemap avant de créer et d'activer leur texte ROBOTS, cela aidera votre site à être exploré plus rapidement et indexé facilement.
Jack
Connie S Owens
Je voudrais empêcher les moteurs de recherche d'indexer mes archives lors de leur exploration.
Emmanuel Nonye
Merci beaucoup, cet article a été vraiment utile.
Cherisa
Je reçois continuellement le message d'erreur ci-dessous sur Google Webmaster. Je suis bloqué. Quelques points qui n'étaient pas clairs pour moi dans ce tutoriel sont : où trouver les fichiers racine de mon site, comment déterminer si j'ai déjà un fichier « robots.txt » et comment le modifier ?
Support WPBeginner
Bonjour Cherisa,
Le dossier racine de votre site est celui qui contient des dossiers comme wp-admin, wp-includes, wp-content, etc. Il contient également des fichiers comme wp-config.php, wp-cron.php, wp-blogheader.php, etc.
Si vous ne voyez pas de fichier robots.txt dans ce dossier, alors vous n'en avez pas. Vous pouvez y aller et en créer un nouveau.
Admin
Cherisa
Merci pour votre réponse. J'ai cherché partout et je n'arrive pas à trouver ces fichiers racines comme vous le décrivez. Y a-t-il un répertoire de chemin que je peux suivre pour accéder à ce dossier. Comme s'il se trouve sous Paramètres, etc. ?
Devender
J'ai eu un trafic web décent sur mon site web. Il a soudainement chuté à zéro au mois de mai. Jusqu'à présent, je rencontre le problème. S'il vous plaît, aidez-moi à récupérer mon site web.
Haris Aslam
Bonjour, merci pour cette information, mais j'ai une question.
J'ai créé le fichier sitemap.xml et robots.txt, et il est bien exploré. Mais comment puis-je créer "Product-Sitemap.xml" ?
Il y a toute la liste des produits dans le fichier sitemap.xml. Dois-je créer Product-sitemap.xml séparément ?
et le soumettre à nouveau à Google ou Bing ?
Pouvez-vous m'aider s'il vous plaît...
Merci
Mahadi Hassan
J'ai un problème avec le réglage du fichier robots.txt. Un seul robots.txt s'affiche pour tous les sites web. S'il vous plaît, aidez-moi à afficher un fichier robots.txt séparé pour tous les sites web. J'ai tous les fichiers robots.txt séparés pour chaque site web individuel. Mais un seul fichier robots.txt s'affiche dans le navigateur pour tous les sites web.
Debu Majumdar
Veuillez expliquer pourquoi vous avez inclus
Disallow: /refer/
dans l'exemple de Robots.txt pour débutants ? Je ne comprends pas les implications de cette ligne. Est-ce important pour un débutant ? Vous avez expliqué les deux autres lignes refusées.
Merci.
Support WPBeginner
Salut Debu,
Cet exemple provient du fichier robots.txt de WPBeginner. Chez WPBeginner, nous utilisons ThirstyAffiliates pour gérer les liens d’affiliation et masquer les URL. Ces URL contiennent /refer/, c’est pourquoi nous les bloquons dans notre fichier robots.txt.
Admin
Evaristo
Comment puis-je mettre toutes les balises/mondomaine.Com en nofollow ? Dans robots.txt pour concentrer le jus de lien ? Merci.
harsh kumar
salut,, j'ai une erreur dans yoast seo concernant le plan du site.. une fois que je clique sur corriger,,, ça revient encore.. le html de mon site ne se charge pas correctement
Tom
Je viens de consulter mon compte Google Webmaster Tools et en utilisant la Search Console, j'ai trouvé ce qui suit :
Page partiellement chargée
Toutes les ressources de la page n'ont pas pu être chargées. Cela peut affecter la façon dont Google voit et comprend votre page. Corrigez les problèmes de disponibilité pour toutes les ressources qui peuvent affecter la façon dont Google comprend votre page.
C'est parce que toutes les feuilles de style CSS associées aux plugins sont interdites par le fichier robots.txt par défaut.
Je comprends les bonnes raisons pour lesquelles je ne devrais pas simplement autoriser cela, mais quelle serait une alternative car je suspecterais que les algorithmes de Google pénalisent le site parce qu'ils ne les voient pas.
Suren
Bonjour,
Lorsque je recherche mon site sur Google, ce texte apparaît sous le lien : « Une description de ce résultat n'est pas disponible en raison du fichier robots.txt de ce site »
Comment puis-je résoudre ce problème ?
Cordialement
Support WPBeginner
Salut Suren,
Il semble que quelqu'un ait accidentellement modifié les paramètres de confidentialité de votre site. Allez dans Paramètres » Page Lecture et faites défiler jusqu'à la section « Visibilité pour les moteurs de recherche ». Assurez-vous que la case à côté de est décochée.
Admin
Divyesh
Bonjour
Comme je l'ai vu dans l'outil pour les webmasters, j'ai un fichier robot.txt comme suit :
User-agent: *
Disallow: /wp-admin/
Allow: /wp-admin/admin-ajax.php
Dites-moi si c'est correct ? Ou dois-je utiliser autre chose ?
John Cester
Je voudrais savoir s'il est judicieux de bloquer (interdire) « /wp-content/plugins/ » dans robots.tx ? Chaque fois que je supprime un plugin, une erreur 404 s'affiche sur certaines pages de ce plugin.
Himanshu singh
J'ai adoré cette explication. En tant que débutant, j'étais très confus au sujet du fichier robot.txt et de ses utilisations. Mais maintenant, je sais quel est son but.
rahul
dans certains fichiers robot.txt, index.php a été interdit. Pouvez-vous expliquer pourquoi ? est-ce une bonne pratique.
Waleed Barakat
Merci d'être passé pour ces précieuses informations.
Awais Ahmed
Pouvez-vous me dire pourquoi cela se produit dans l'outil pour les webmasters :
Réseau inaccessible : robots.txt inaccessibleNous n'avons pas pu explorer votre sitemap car nous avons trouvé un fichier robots.txt à la racine de votre site mais nous n'avons pas pu le télécharger. Veuillez vous assurer qu'il est accessible ou supprimez-le complètement.
le fichier robots.txt existe mais toujours
Dozza
Mise à jour intéressante de l'équipe Yoast à ce sujet sur
Citation : « Les anciennes bonnes pratiques consistant à avoir un robots.txt qui bloque l'accès à votre répertoire wp-includes et à votre répertoire de plugins ne sont plus valides. »
natveimaging
Autoriser : /wp-content/uploads/
Ne devrait-ce pas être ?
Disallow: /wp-content/uploads/
Parce que vous êtes conscient que Google indexera toutes vos pages de téléchargement en tant qu'URL publiques, n'est-ce pas ? Et ensuite, vous recevrez des erreurs pour la page elle-même. Y a-t-il quelque chose que je manque ici ?
nativeimaging
Dans l'ensemble, ce sont les pages réelles que Google explore pour générer des cartes d'images, PAS les dossiers de téléchargement. Ensuite, vous auriez un problème avec toutes les petites tailles d'images et d'autres images destinées à l'interface utilisateur qui seraient également indexées.
Cela semble être la meilleure option :
Disallow: /wp-content/uploads/
Si je me trompe, veuillez m'expliquer cela afin que je puisse comprendre votre point de vue.
Jason
Mon URL de blog n'est pas indexée, dois-je changer mon robots.txt ?
J'utilise ce robots.txt
iyan
comment créer un fichier robot txt qui autorise UNIQUEMENT l'indexation des pages et des articles.. merci
Simaran Singh
Je ne suis pas sûr du problème, mais mon robots.txt a deux versions.
Une à http://www.example.com/robots.txt et une seconde à example.com/robots.txt
Quelqu'un peut m'aider, s'il vous plaît ! Dites-moi quelle peut être la cause possible et comment la corriger ?
Support WPBeginner
Très probablement, votre hébergeur permet d'accéder à votre site avec des URL www et non-www. Essayez de modifier robots.txt à l'aide d'un client FTP. Examinez-le ensuite à partir des deux URL si vous pouvez voir vos modifications sur les deux URL, cela signifie que c'est le même fichier.
Admin
Simaran Singh
Merci pour la réponse rapide. Je l'ai déjà fait, mais je ne vois aucun changement. Y a-t-il un autre moyen de résoudre ce problème ?
Martin conde
Le billet de blog de Yoast sur ce sujet était juste au-dessus du vôtre dans ma recherche, alors bien sûr, j'ai consulté les deux. Ils se contredisent un peu. Par exemple, Yoast a dit que le fait de ne pas autoriser les répertoires de plugins et autres pourrait gêner les robots d'exploration de Google lors de la récupération de votre site, car les plugins peuvent générer du CSS ou du JS. Il a également mentionné (et d'après ma propre expérience), que Yoast n'ajoute rien lié au sitemap au robots.txt, mais le génère de telle sorte que vous puissiez l'ajouter à votre console de recherche. Voici le lien vers son article, peut-être pourrez-vous vérifier à nouveau car il est très difficile de choisir à qui se fier
MM Nauman
Comme je ne suis pas doué pour créer ce fichier Robotstxt, puis-je utiliser votre fichier Robots.txt en modifiant les paramètres comme l'URL et le sitemap de mon site, est-ce bien ? ou devrais-je en créer un différent
Mohit Chauhan
Bonjour,
Aujourd'hui, j'ai reçu cet e-mail de Google : « Googlebot ne peut pas accéder aux fichiers CSS et JS »… quelle peut être la solution ?
Merci
Parmod
Laissez-moi deviner… Vous utilisez des services CDN pour importer des fichiers CSS et JS.
ou
Il est possible que vous ayez écrit une syntaxe incorrecte dans ces fichiers.
Rahul
J'ai une question sur l'ajout de sitemaps. Comment puis-je ajouter les sitemaps Yahoo et Bing au fichier Robots et au répertoire WordPress ?
Gerbrand Petersen
Merci pour le plan détaillé de l'utilisation du fichier robots.txt. Quelqu'un sait-il si Yahoo utilise également ce robots.txt, et s'il respecte les règles mentionnées dans le fichier ? Je pose cette question car j'ai un « Disallow » pour une certaine page dans mon fichier, mais je reçois du trafic venant de Yahoo sur cette page. Rien de Google, comme il se doit. Merci d'avance.
Erwin
correction…
« Si vous utilisez le plugin Yoast’s WordPress SEO ou un autre plugin pour générer votre sitemap XML, alors votre plugin essaiera d'ajouter automatiquement les lignes relatives à votre sitemap dans le fichier robots.txt. »
Pas vrai. WordPress SEO n'ajoute pas le sitemap au robots.txt
« J'ai toujours pensé que lier votre sitemap XML depuis votre robots.txt était un peu absurde. Vous devriez les ajouter manuellement à vos Google et Bing Webmaster Tools et vous assurer de consulter leurs commentaires sur votre sitemap XML. C'est la raison pour laquelle notre plugin WordPress SEO ne l'ajoute pas à votre robots.txt. »
https://yoast.com/wordpress-robots-txt-example/
Il est également plus recommandé de ne pas interdire le répertoire wp-plugins (voir les raisons dans l'article de Yoast)
Et personnellement, j'aime simplement supprimer le fichier readme.txt...
hyma
J'ai compris le fichier robots.txt et son utilisation. Qu'est-ce que le sitemap et comment puis-je créer un sitemap pour mon site ?
Rick R. Duncan
Après avoir lu la documentation de Google, j'ai l'impression que la directive à utiliser dans le fichier robots.txt est disallow, qui indique seulement aux bots ce qu'ils peuvent et ne peuvent pas explorer. Cela ne leur dit pas ce qui peut et ne peut pas être indexé. Vous devez utiliser la balise meta robots noindex pour qu'une page ne soit pas indexée.
Nitin
article vraiment bon pour un fichier robots.txt optimisé pour le SEO. Mais j'ai besoin que vous donniez un tutoriel sur la façon de téléverser un fichier robots.txt sur un serveur. En tant que débutant, cela semble être un problème majeur de téléverser ce fichier.
Au fait, merci d'avoir partagé des informations si bénéfiques.
-Nitin
Parmod
Téléchargez-le sur votre serveur/public_hmtl/(Votre-nom-de-site)... dans ce dossier
Jenny
Quelle est la meilleure façon d'ajouter du code à HTTacess pour bloquer plusieurs referrers de bots spam pour leur URL et leur adresse IP s'il n'y a pas d'URL donnée ?
Je sais que si vous avez une syntaxe incorrecte lors de la modification de httacess, cela peut mettre votre site hors ligne. Je suis un débutant et j'ai besoin de bloquer ces multiples URL ennuyeuses de Russie, de Chine, d'Ukraine, etc.
Merci beaucoup
Hazel Andrews
Merci pour ces conseils... les fichiers robot txt sont maintenant modifiés ! youpi !
Rahat
pourquoi faut-il ajouter Allow: !!!
si je mentionne seulement ce qui doit être Disallow, c'est suffisant. Je n'ai pas besoin d'écrire de code pour Allow car Googlebot ou Bingbot exploreront automatiquement tout le reste.
Alors pourquoi devrais-je utiliser à nouveau Allow ?
Connor Rickett
Puisque l'absence du fichier Robots.txt n'empêche pas le site d'être exploré, je suis curieux : existe-t-il des données concrètes sur la façon dont la présence du fichier améliore les performances SEO ?
J'ai fait une recherche rapide sur Google et je n'ai pas trouvé de données quantitatives à ce sujet. Il y a environ un demi-million d'articles disant : « Hé, cela améliore le SEO ! », mais j'aimerais vraiment savoir de quoi nous parlons ici, même de manière générale.
Est-ce une amélioration de 5 % ? 50 ? 500 ?
Support WPBeginner
Les moteurs de recherche ne partagent pas de telles données. Bien que l'absence d'un fichier robots.txt n'empêche pas les moteurs de recherche d'explorer ou d'indexer un site web. Cependant, c'est une bonne pratique recommandée.
Admin
Connor Rickett
Merci d'avoir pris le temps de me répondre, j'apprécie !
JD Myers
Bon timing pour cela. J'essayais de trouver cette information hier.
La raison pour laquelle je la cherchais est que les outils Google Webmaster me disaient qu'ils ne pouvaient pas explorer correctement mon site car je bloquais diverses ressources nécessaires au bon rendu de la page.
Ces ressources comprenaient celles trouvées dans /wp-content/plugins/
Après avoir autorisé ce dossier, l'avertissement a disparu.
Des idées à ce sujet ?
Support WPBeginner
Vous pouvez ignorer ces avertissements en toute sécurité. Ce n'est qu'un avertissement si vous aviez réellement du contenu que vous souhaiteriez indexer. Parfois, les utilisateurs ont restreint les robots de recherche et l'ont oublié. Ces avertissements sont utiles dans ces situations.
Admin
Chetan jadhav
J'ai une question : beaucoup de gens utilisent un sitemap statique, et vous savez qu'ils ont un site WordPress. Devrions-nous utiliser un sitemap statique ou un sitemap généré par WordPress ?
Wilton Calderon
Sympa, j'aime la façon dont Wpbeginner le fait, et avec ce classement Alexa, cela me semble être la meilleure façon d'utiliser robots.txt...
Brigitte Burke
Que signifie mon fichier robots.txt s'il ressemble à ceci ?
User-agent: *
Disallow: /wp-admin/
Disallow: /wp-includes/
Disallow: /xmlrpc.php
Personnel éditorial
Cela indique simplement que les moteurs de recherche ne doivent pas indexer votre dossier wp-admin, votre dossier wp-includes et le fichier xml-rpc. Parfois, interdire /wp-includes/ peut bloquer certains scripts pour les moteurs de recherche, surtout si votre site utilise ces scripts. Cela peut nuire à votre SEO.
La meilleure chose à faire est d'aller sur Google Webmaster Tools et de récupérer votre site web en tant que bot. Si tout se charge correctement, vous n'avez rien à craindre. S'il indique que des scripts sont bloqués, vous voudrez peut-être supprimer la ligne wp-includes.
Admin
hercules
Je ne vois aucune logique dans votre idée d'avoir un script dans le répertoire includes qui puisse être utilisé par un robot d'exploration / robot... et d'autre part, s'il y a un cas isolé, il est préférable après avoir spécifié le défaut WordPress autorise ce fichier que vous imaginez que les moteurs de recherche utilisent ses scripts ! après tout, WordPress n'a certainement pas par défaut un robots.txt anti-moteurs de recherche !!!!