{"id":1407,"date":"2018-02-05T12:02:10","date_gmt":"2018-02-05T12:02:10","guid":{"rendered":"https:\/\/sitechecker.pro\/?page_id=1407"},"modified":"2023-10-10T12:42:19","modified_gmt":"2023-10-10T10:42:19","slug":"xml-sitemap","status":"publish","type":"page","link":"https:\/\/test.sitechecker.pro\/fr\/xml-sitemap\/","title":{"rendered":"Les probl\u00e8mes de Sitemap XML qui peuvent faire \u00e9chouer l\u2019indexation"},"content":{"rendered":"<p>Qu\u2019est ce que le fichier Sitemap.xml ? C\u2019est un fichier simple qui contient de nombreuses commandes \u00e9crites pour coop\u00e9rer avec les robots des moteurs de recherche (comme le <a href=\"http:\/\/test.sitechecker.pro\/fr\/google-bot\/\">Googlebot<\/a>). Il dispose de fonctionnalit\u00e9s permettant de promouvoir les pages en haut des <a href=\"http:\/\/test.sitechecker.pro\/fr\/serp\/\">r\u00e9sultats de recherche<\/a>, en facilitant la mani\u00e8re dont l\u2019algorithme num\u00e9rique comprend l\u2019organisation de votre site web.<\/p>\n<p>On va utiliser notre imagination. Sitemap.xml est un type de couloir qui rassemble toutes vos pages HTML pour les <a href=\"http:\/\/test.sitechecker.pro\/fr\/search-engines\/\">moteurs de recherche<\/a> en les rendant \u00ab visibles \u00bb. Il est essentiel de comprendre cette notion avant de passer \u00e0 la suite. Continuez la lecture de cet article pour d\u00e9couvrir les fausses id\u00e9es au sujet des sitemaps.<\/p>\n<h2>Les probl\u00e8mes d\u2019indexation<\/h2>\n<p>&nbsp;<\/p>\n<p>Durant la lecture de cet article, d\u00e9barrassons-nous d\u2019abord de l\u2019id\u00e9e fausse la plus r\u00e9pandue : le sitemap XML contribuerait \u00e0 l\u2019indexation de toutes les pages du site web. Ce n\u2019est pas correct. Ce fichier n\u2019est pas con\u00e7u pour envoyer poliment des demandes d\u2019indexation au robot de d\u00e9couverte du moteur de recherche. Google se d\u00e9brouille tr\u00e8s bien tout seul pour cela. Il parcourt le site web et s\u00e9lectionne les pages de meilleure qualit\u00e9 (selon lui) pour les indexer. Les sitemaps ne sont pas cens\u00e9s attirer l\u2019attention du syst\u00e8me de recherche comme beaucoup de gens le pensent.<\/p>\n<p>Le sitemap est une sorte de filtre inject\u00e9 dans la console de recherche de Google. Il synth\u00e9tise des notions au sein d\u2019un algorithme qui indique quelle est la page d\u2019atterrissage ad\u00e9quate qui sera scann\u00e9e. Il donne simplement des indications \u00e0 l\u2019intelligence artificielle pour lui recommander les pages les plus pertinentes. C\u2019est tout.<\/p>\n<h2>Manque de coh\u00e9rence<\/h2>\n<p>&nbsp;<\/p>\n<p>Dans de nombreux exemples de fichiers sitemap XML, un professionnel peut d\u00e9tecter facilement un d\u00e9faut simple : le message sur l\u2019\u00e9tat de la page \u00e0 indexer transf\u00e9r\u00e9 au syst\u00e8me de recherche n\u2019est pas coh\u00e9rent. La description du sitemap XML est parfois contraire aux actions du \u00ab meta robots \u00bb. Les commandes suivantes peuvent porter \u00e0 confusion.<\/p>\n<ul>\n<li>\u00a0\u00ab Noindex \u00bb \u2013 comme son nom l\u2019indique, cette commande pr\u00e9cise qu\u2019il n\u2019est pas n\u00e9cessaire d\u2019indexer la page.<\/li>\n<li>\u00ab <a href=\"http:\/\/test.sitechecker.pro\/fr\/nofollow-links\/\">Nofollow<\/a> \u00bb \u2013 cette page ne contient aucune information de valeur.<\/li>\n<li>\u00ab Noindex,nofollow, \u00bb \u2013 cette page sera per\u00e7ue par le syst\u00e8me comme une page fant\u00f4me. C\u2019est le probl\u00e8me le plus fr\u00e9quent car il conduit parfois \u00e0 l\u2019inutilit\u00e9 du site web qui devrait \u00eatre index\u00e9.<\/li>\n<\/ul>\n<p>Il faut faire attention \u00e0 v\u00e9rifier que les commandes ne vont pas l\u2019une \u00e0 l\u2019encontre de l\u2019autre. Autrement dit, toutes les informations devraient \u00eatre filtr\u00e9es en respectant deux param\u00e8tres simples :<\/p>\n<ul>\n<li>\u00a0Les pages utiles contiennent des informations destin\u00e9es aux humains qui naviguent en ligne. Le webmaster devrait utiliser \u00ab noindex, follow \u00bb pour les robots et les supprimer du sitemap XML.<\/li>\n<li>Pages d\u2019atterrissage pour les robots \u2013 le texte qui est con\u00e7u \u00e0 destination des robots des moteurs de recherche et sera pris en compte pour grimper dans les premiers r\u00e9sultats de recherche. Ces pages doivent \u00eatre ajout\u00e9es au fichier XML. Il est n\u00e9cessaire de renseigner une exception pour \u00e9viter d\u2019\u00eatre banni par les robots.<\/li>\n<\/ul>\n<h2>D\u00e9veloppement global du site<\/h2>\n<p>&nbsp;<\/p>\n<p>Certains pensent que les m\u00e9canismes de recherche ont un param\u00e8tre ou une mesure personnelle, qui s\u00e9lectionne les pages web \u00e0 mettre en avant. Pourtant, si on essaie de raisonner comme une machine et d\u2019analyser un millier de sites, on remarquera rapidement une corr\u00e9lation simple. Si seulement 5 ou 6 pages ont \u00e9t\u00e9 cr\u00e9\u00e9es pour les ordinateurs, et toutes les autres pour les humains, alors le site n\u2019occupera pas les premi\u00e8res places de la page de r\u00e9sultats du moteur de recherche. Il faut trouver un \u00e9quilibre entre les contenus \u00e0 destination des ordinateurs et des humains pour que l\u2019optimisation permette de promouvoir le site web.<\/p>\n<p>Il est recommand\u00e9 d\u2019utiliser le texte \u00e0 destination des machines sur les pages qui ne n\u00e9cessitent pas de lecture humaine et de les renseigner dans le fichier XML. Les meilleurs choix de pages d\u2019atterrissage sont les sections de connexion, de commentaire, de r\u00e9cup\u00e9ration du mot de passe et de partage du contenu. Toutefois, c\u2019est loin d\u2019\u00eatre suffisant. Le m\u00e9lange id\u00e9al consiste \u00e0 inclure environ 50% du contenu dans l\u2019indexation Google. Par cons\u00e9quent, avoir davantage de pages \u00e0 destination des robots v\u00e9rifi\u00e9es par un fichier XML permet de rendre le site plus populaire. Pour mettre en avant un site web, il faut imp\u00e9rativement faire preuve de flexibilit\u00e9.<\/p>\n<h2>Les probl\u00e8mes de tr\u00e8s gros sites web<\/h2>\n<p>&nbsp;<\/p>\n<p>Les webmasters ayant des sites web gigantesques ont peur de modifier le fichier XML parce qu\u2019ils pensent qu\u2019il est n\u00e9cessaire de renseigner manuellement chaque page. Ceux dont le site web comporte plus de 1 000 pages consid\u00e8rent cela comme un vrai cauchemar. Heureusement, il s\u2019agit encore une fois d\u2019une id\u00e9e fausse. Les fichiers statiques sont d\u00e9mod\u00e9s et conviennent davantage aux sites web \u00ab carte de visite \u00bb de toute petite taille.<\/p>\n<p>De gros sites web peuvent b\u00e9n\u00e9ficier fortement des fichiers XML dynamiques de plus en plus r\u00e9pandus. Ils s\u2019ajustent automatiquement pour les robots. Le webmaster n\u2019aura m\u00eame pas besoin de les envoyer manuellement \u00e0 la console de recherche Google. Le document contient un jeu de param\u00e8tres. Ceux-ci s\u2019appliqueront \u00e0 la totalit\u00e9 du site web de la mani\u00e8re d\u00e9crite dans la section sur les commandes \u00e0 envoyer aux robots. La totalit\u00e9 du site web sera cat\u00e9goris\u00e9e en suivant de simples crit\u00e8res \u00ab oui \u00bb &#8211; \u00ab non \u00bb.<\/p>\n<p>C\u2019est particuli\u00e8rement efficace pour les sites comprenant de nombreux types de contenus diff\u00e9rents. Le sitemap XML sera en mesure de discerner quels sont les fichiers et objets cach\u00e9s n\u00e9cessaires et utiles pour l\u2019indexation automatis\u00e9e. Chaque page web mise \u00e0 jour suivra le m\u00eame traitement d\u2019apr\u00e8s les conditions fix\u00e9es dans le fichier dynamique. Un fichier XML dynamique d\u00e9termine si la page est \u00e0 indexer ou non en prenant en compte les param\u00e8tres pr\u00e9cis\u00e9s en amont.<\/p>\n<h2>Un bon r\u00e9sum\u00e9<\/h2>\n<p>&nbsp;<\/p>\n<p>Afin de synth\u00e9tiser toutes les informations pr\u00e9sent\u00e9es au sujet des particularit\u00e9s de ce fichier XML, nous pouvons vous rappeler les principes fondamentaux d\u2019utilisation. Nous esp\u00e9rons que vos sites web existants et futurs seront facilement trouv\u00e9s et mis en avant par les syst\u00e8mes de recherche.<\/p>\n<ul>\n<li>\u00a0Envoyez toujours des commandes correctes et coh\u00e9rentes. Vous pouvez v\u00e9rifier leur exactitude gr\u00e2ce \u00e0 un testeur de sitemaps. Cela garantira l\u2019efficacit\u00e9 de ce composant logiciel.<\/li>\n<li>Pour de gros sites web, un fichier XML sera plus efficace car il tiendra compte de toutes les activit\u00e9s et de toutes les donn\u00e9es entre les robots, meta robots et les moteurs de recherche.<\/li>\n<li>Utilisez un v\u00e9rificateur de sitemap suppl\u00e9mentaire con\u00e7u pour \u00e9viter toute incoh\u00e9rence durant l\u2019indexation par les moteurs de recherche. Vous devez \u00eatre certain que Google choisit la bonne option.<\/li>\n<\/ul>\n<p>Si la programmation vous passionne et que vous souhaitez mettre en pratique toutes vos id\u00e9es dans un site web qui marche, n\u2019ignorez jamais les outils puissants qui permettront de faire d\u00e9couvrir votre portail au plus grand nombre de personnes. Il est fondamental de comprendre le fonctionnement des logiciels pour r\u00e9ussir tout en pr\u00e9servant votre ressource la plus pr\u00e9cieuse : le temps.<\/p>","protected":false},"excerpt":{"rendered":"Qu\u2019est ce que le fichier Sitemap.xml ? C\u2019est un fichier simple qui contient de nombreuses commandes \u00e9crites pour coop\u00e9rer avec les robots des moteurs de recherche (comme le Googlebot). Il dispose de fonctionnalit\u00e9s permettant de promouvoir les pages en haut des r\u00e9sultats de recherche, en facilitant la mani\u00e8re dont l\u2019algorithme num\u00e9rique comprend l\u2019organisation de votre&#8230;","protected":false},"author":10380808,"featured_media":3440,"parent":0,"menu_order":0,"comment_status":"closed","ping_status":"closed","template":"pages-templates\/pages-minitools.php","meta":[],"categories":[59],"tags":[],"_links":{"self":[{"href":"https:\/\/test.sitechecker.pro\/fr\/wp-json\/wp\/v2\/pages\/1407"}],"collection":[{"href":"https:\/\/test.sitechecker.pro\/fr\/wp-json\/wp\/v2\/pages"}],"about":[{"href":"https:\/\/test.sitechecker.pro\/fr\/wp-json\/wp\/v2\/types\/page"}],"author":[{"embeddable":true,"href":"https:\/\/test.sitechecker.pro\/fr\/wp-json\/wp\/v2\/users\/10380808"}],"replies":[{"embeddable":true,"href":"https:\/\/test.sitechecker.pro\/fr\/wp-json\/wp\/v2\/comments?post=1407"}],"version-history":[{"count":0,"href":"https:\/\/test.sitechecker.pro\/fr\/wp-json\/wp\/v2\/pages\/1407\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/test.sitechecker.pro\/fr\/wp-json\/wp\/v2\/media\/3440"}],"wp:attachment":[{"href":"https:\/\/test.sitechecker.pro\/fr\/wp-json\/wp\/v2\/media?parent=1407"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/test.sitechecker.pro\/fr\/wp-json\/wp\/v2\/categories?post=1407"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/test.sitechecker.pro\/fr\/wp-json\/wp\/v2\/tags?post=1407"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}