...
Contact Contact

Sitemap XML expliqué : quoi inclure, quoi exclure et comment lire les résultats

XML Sitemaps Explained: What to Include, What to Leave Out, and How to Read the Results XML Sitemaps Explained: What to Include, What to Leave Out, and How to Read the Results

Un sitemap XML est une liste des URL que vous voulez voir indexées — rien de plus. Il ne remplace pas le maillage interne et ne garantit pas l’indexation, mais il indique à Google quelles pages existent et quand elles ont changé pour la dernière fois. Sur les sites récents, volumineux ou mal maillés, c’est la différence entre « trouvé en quelques jours » et « en quelques mois ».

Ce qui doit figurer dans le sitemap XML

  • Toutes les pages qui doivent apparaître dans la recherche : accueil, catégories, produits, articles, pages d’atterrissage.
  • Uniquement la version canonique de chaque URL : pas http et https, pas avec et sans barre finale.
  • Uniquement des pages en statut 200, non bloquées par noindex ni robots.txt.

Ce qu’il faut exclure

  • Archives d’étiquettes, pages d’auteur, pagination, résultats de recherche, URL de filtres.
  • Redirections, pages 404, connexion et panier.
  • Pages en noindex : c’est contradictoire et cela coûte en confiance.

La règle pratique : si une page ne devrait pas être un résultat de recherche, elle n’a rien à faire dans le sitemap XML. Le générateur de sitemap XML vérifie le statut et les doublons des URL avant de construire le fichier.

Limites et structure

50 000 URL et 50 Mo non compressés maximum par fichier ; au-delà, un index de sitemaps pointant vers plusieurs fichiers. Il est judicieux de découper par type (pages, articles, produits, images) : dans la Search Console, on voit aussitôt quelle section pose problème. WordPress avec Yoast ou Rank Math génère exactement cette structure sous /sitemap_index.xml.

Advertisement

lastmod : la seule donnée que Google utilise

<lastmod> avec la vraie date de modification aide Google à explorer d’abord les pages modifiées. <priority> et <changefreq> sont largement ignorés. Important : ne changez lastmod que si le contenu a changé ; mettre la date du jour à chaque build annule le signal.

Lire le rapport Sitemaps

Search Console → Sitemaps : « Opération réussie » signifie seulement que le fichier est lisible. Ce qui compte, c’est la comparaison entre « URL découvertes » et « URL indexées » dans Pages : si l’indexation est nettement inférieure au nombre du sitemap, il y a des problèmes de qualité ou de doublons. « Explorée, actuellement non indexée » signale un contenu mince ; « Page en double sans URL canonique sélectionnée par l’utilisateur », des balises canonical manquantes.

Questions fréquentes

Le sitemap doit-il figurer dans le robots.txt ?

Ce n’est pas obligatoire, mais la ligne Sitemap: https://…/sitemap_index.xml aide Bing et les autres moteurs à le trouver. Le générateur de robots.txt l’ajoute automatiquement.

À quelle fréquence Google lit-il le sitemap ?

Sur les sites actifs, chaque jour ; après soumission dans la Search Console, en quelques heures.

Les images ont-elles besoin d’un sitemap dédié ?

Seulement si elles sont chargées en JavaScript ou si la recherche d’images est un objectif ; sinon, l’intégration dans les pages normales suffit.

Essayez maintenant : Générateur de sitemap XML

Gratuit, fonctionne dans votre navigateur, rien n’est envoyé, sans inscription.

Ouvrir l’outil →
Add a comment Add a comment

Leave a Reply

Your email address will not be published. Required fields are marked *

Submit Comment

Advertisement
Seraphinite AcceleratorOptimized by Seraphinite Accelerator
Turns on site high speed to be attractive for people and search engines.