Les sitemaps sont-ils encore utiles ? Google répond

Google recommande de conserver les sitemaps XML, surtout sur les sites volumineux ou souvent actualisés. Il précise aussi l’usage de lastmod, des URL canoniques et les causes possibles d’une erreur dans Search Console.

Cartographie lumineuse du crawl Google
Illustration générée par IA — Position Zéro
Partager
Dans cet articleSommaire
  1. Google recommande de conserver les sitemaps XML
  2. Google utilise encore lastmod sous certaines conditions
  3. Les flux RSS complètent les sitemaps XML
  4. HTML et llms.txt ne remplacent pas le sitemap
  5. « Impossible de récupérer » ne signale pas toujours un fichier incorrect

Dans un épisode de Search Off the Record publié le 1er octobre 2026, Martin Splitt et John Mueller répondent aux questions consacrées aux sitemaps. Tous deux travaillent au sein de l’équipe Search Relations de Google et interviennent sur le crawl, l’indexation et Search Console.

Google recommande de conserver les sitemaps XML

Selon John Mueller, les petits sites n’ont pas toujours besoin d’un sitemap XML. Google peut généralement découvrir leurs pages grâce aux liens internes. Il conseille tout de même de garder le sitemap activé, puisque la plupart des CMS le produisent automatiquement.

Le fichier devient surtout utile pour les sites aux contenus nombreux. Il aide Google à repérer une nouvelle URL ou une modification sans devoir parcourir toute l’arborescence. Les sites d’actualité et les boutiques en ligne peuvent ainsi signaler plus rapidement leurs pages régulièrement mises à jour.

Google ne promet pas le crawl ou l’indexation de chaque adresse déclarée. Le sitemap fournit une liste d’URL à examiner, sans imposer leur traitement au moteur.

Google utilise encore lastmod sous certaines conditions

Google ne tient plus compte des champs <priority> et <changefreq>. Leur utilisation s’est révélée peu fiable, car de nombreux sites attribuaient une priorité maximale ou une fréquence élevée à toutes leurs pages. En pratique, priority et changefreq sont ignorés.

Publicité

Le champ <lastmod> reste pris en compte lorsque ses valeurs paraissent cohérentes. La date de dernière modification doit correspondre à un changement significatif de la page. Si toutes les URL reçoivent systématiquement la date du jour, Google peut cesser d’utiliser cette information. Mueller précise que ce comportement ne relève pas d’une sanction antispam.

Le fichier doit aussi contenir les versions canoniques des URL, sans paramètres de suivi ni horodatage ajouté à leur adresse. Leur présence dans le sitemap constitue l’un des signaux dont Google peut tenir compte pour choisir une URL canonique.

Les flux RSS complètent les sitemaps XML

Un flux RSS répertorie principalement les URL récemment modifiées, avec leur date de publication ou d’actualisation. Google autorise sa soumission dans Search Console comme un sitemap.

Le flux RSS ne couvre généralement que les dernières publications. Il complète donc le fichier XML, qui peut contenir l’ensemble des pages indexables. Sur un site doté de nombreux sitemaps, le flux permet au moteur d’identifier directement les contenus récents.

Un sitemap XML peut contenir 50 000 URL par fichier et peser jusqu’à 50 Mo avant compression. Lorsque ces limites sont atteintes, le site peut utiliser un index de sitemaps. Cet index doit renvoyer vers des fichiers de sitemaps, sans contenir un autre index.

HTML et llms.txt ne remplacent pas le sitemap

Un sitemap HTML rassemble des liens destinés aux visiteurs. Les moteurs peuvent les suivre comme les autres liens d’une page, mais ce format ne remplace pas le XML et ne peut pas être soumis comme tel dans Search Console.

Publicité

Le fichier llms.txt repose pour sa part sur du Markdown. Il présente généralement une sélection de liens vers les principales rubriques ou ressources d’un site. Google ne le traite actuellement pas comme un sitemap et ne recommande pas de compter sur une éventuelle prise en charge future.

John Mueller indique avoir observé l’accès des crawlers IA à ses sitemaps et à ses flux RSS dans ses journaux serveur. Il précise ne pas savoir comment ces fichiers sont ensuite utilisés par les systèmes concernés.

« Impossible de récupérer » ne signale pas toujours un fichier incorrect

Search Console peut afficher le message « Impossible de récupérer » pour un fichier pourtant valide, accessible publiquement et déclaré dans le fichier robots.txt.

John Mueller cite d’abord la charge du serveur. Les systèmes de Google peuvent consacrer leurs ressources à d’autres URL et ne pas disposer de capacité pour télécharger le sitemap au moment prévu.

La seconde explication concerne la demande de crawl. Lorsque les systèmes de Google estiment qu’ils n’ont pas besoin d’explorer davantage un site, ils peuvent différer la lecture du fichier. Mueller ajoute que cette demande dépend notamment de la qualité globale perçue par Google. Le message ne désigne donc pas nécessairement une erreur de syntaxe dans le XML.

Jordan Belly
Auteur

Jordan Belly

Rédacteur web SEO à Toulouse, j’interviens depuis plus de vingt ans sur le contenu éditorial, dont plus de douze ans dédiés au référencement naturel. J’accompagne les entreprises dans la construction de leur visibilité en ligne, en m’appuyant sur une veille continue des évolutions de Google et des moteurs basés sur l’IA. Je continue par ailleurs à écrire pour la presse spécialisée (Système D, Le Particulier, UFC Que Choisir…) et suis l’auteur du Guide du rédacteur web (Edi.Pro).

Voir ses publications
À lire aussi

À lire ensuite

Gérer mes choix de confidentialité