Retour aux guides

Sitemaps XML : Donner aux crawlers une carte propre de votre site

Un sitemap est un outil de découverte plutôt qu’un levier de classement. Comment garder le vôtre découvrable et honnête, et quelles URLs ne devraient jamais y apparaître.

Un sitemap est un outil de découverte. Il indique aux moteurs de recherche quelles URLs vous considérez dignes d’être crawlées et approximativement quand chacune a changé pour la dernière fois. Sur un petit site avec un maillage interne propre, il change peu. Sur un grand site, un nouveau site, ou un site où les pages utiles se trouvent à 4 clics de la page d’accueil, il est souvent la différence entre une page trouvée cette semaine et la prochaine année. Deux propriétés rendent un sitemap utile : il est découvrable, et il est honnête. Découvrable signifie qu’il est référencé depuis robots.txt ou soumis directement, et qu’il vit à une URL stable. Honnête signifie que chaque URL y est celui que vous voudriez indexer, c’est‑à‑dire canonique, renvoyant 200, et ouvert au crawl. Le défaut le plus courant est un sitemap généré une fois et jamais régénéré, listant des URLs qui redirigent maintenant ou 404 tout en omettant tout ce qui a été publié depuis. Le second est un sitemap contenant chaque URL que le CMS peut produire, y compris les archives de tags, les doublons paginés et les variantes paramétrées. Les deux enseignent aux moteurs de recherche à faire moins confiance au fichier. Ces vérifications confirment que le sitemap peut être trouvé, qu’il est valide XML, et qu’il utilise correctement l’index et la structure enfant. Elles relisent ensuite chaque URL répertoriée à la lumière de vos propres directives, car un fichier qui nomme des URLs bloquées, noindexées ou non canoniques se contredit, et les moteurs de recherche tranchent en accordant moins de confiance au fichier.

Sitemap non trouvé

Pourquoi cela compte

Un plan du site aide les moteurs de recherche à trouver vos pages importantes plus rapidement et de façon plus cohérente.

Comment nous vérifions

Le sitemap a été vérifié pour sa présence via référence robots.txt ou emplacement bien connu.

Comment corriger

Liez votre plan de site XML depuis robots.txt avec une directive Sitemap et le plan de site absolu URL, ou soumettez-le directement à Google Search Console. Incluez les URL canoniques que vous souhaitez que les moteurs de recherche considèrent ; un plan de site facilite la découverte mais ne garantit pas que chaque URL listé sera exploré ou affiché.

Sitemap XML invalide

Comment nous vérifions

Le sitemap complet a été analysé comme XML et vérifié pour l'espace de noms et la forme de document sitemap, des valeurs loc absolues du même site, et des dates lastmod W3C valides ou des datetimes avec fuseau horaire.

Comment corriger

Corrigez les erreurs de validation XML dans votre sitemap. Utilisez un outil de validation de sitemap.

robots.txt déclare un sitemap sur un autre site web

Pourquoi cela compte

Les robots qui suivent cette déclaration dépensent le budget d'exploration du site sur les pages d'un autre domaine, généralement un vestige de migration inachevée.

Comment nous vérifions

Chaque ligne Sitemap: de robots.txt a été comparée au domaine qui sert le fichier.

Comment corriger

Hébergez le sitemap sur le domaine qu'il décrit et mettez à jour la ligne Sitemap: de robots.txt. Une déclaration hors domaine révèle généralement une migration inachevée ou un robots.txt servi par le mauvais site.

URL du sitemap sans index

Pourquoi cela compte

Un noindex accidentel ou un blocage robots retire des pages des résultats de recherche sans aucune erreur visible sur le site.

Comment nous vérifions

Les URL du sitemap ont été vérifiées pour les directives noindex.

Comment corriger

Supprimez noindex des pages listées dans votre sitemap, ou supprimez-les du sitemap. Pourquoi c'est important : les URL du sitemap avec noindex créent une contradiction directe qui gaspille le budget d'exploration et signale une mauvaise maintenance du site aux moteurs de recherche.

URL du sitemap bloquée dans robots.txt

Comment nous vérifions

Les URL du sitemap ont été vérifiées par rapport aux règles Disallow du robots.txt.

Comment corriger

Supprimez les règles Disallow du robots.txt pour les pages listées dans votre sitemap. Pourquoi c'est important : bloquer les URL du sitemap dans le robots.txt crée une contradiction — les moteurs de recherche voient que vous recommandez des pages que vous leur interdisez simultanément d'accéder, ce qui érode la confiance dans votre sitemap.

URL du sitemap non canonique

Pourquoi cela compte

Un sitemap listant des URL non canoniques envoie aux moteurs de recherche des instructions contradictoires sur la vraie version d'une page.

Comment nous vérifions

Les URL du sitemap ont été vérifiées pour la cohérence canonique.

Comment corriger

Corrigez les URL du sitemap qui pointent vers des pages non canoniques. Le sitemap doit lister les URL canoniques. Pourquoi c'est important : les URL non canoniques dans les sitemaps divisent le budget d'exploration entre les doublons et peuvent amener les moteurs de recherche à indexer la mauvaise version de votre contenu.

Voir comment votre site se classe

Get a free IA-powered SEO report with actionable findings and priority fixes for your website.

Aucune inscription requise.