Dans un épisode de Search Off the Record publié le 1er octobre 2026, Martin Splitt et John Mueller répondent aux questions consacrées aux sitemaps. Tous deux travaillent au sein de l’équipe Search Relations de Google et interviennent sur le crawl, l’indexation et Search Console.
Google recommande de conserver les sitemaps XML
Selon John Mueller, les petits sites n’ont pas toujours besoin d’un sitemap XML. Google peut généralement découvrir leurs pages grâce aux liens internes. Il conseille tout de même de garder le sitemap activé, puisque la plupart des CMS le produisent automatiquement.
Le fichier devient surtout utile pour les sites aux contenus nombreux. Il aide Google à repérer une nouvelle URL ou une modification sans devoir parcourir toute l’arborescence. Les sites d’actualité et les boutiques en ligne peuvent ainsi signaler plus rapidement leurs pages régulièrement mises à jour.
Google ne promet pas le crawl ou l’indexation de chaque adresse déclarée. Le sitemap fournit une liste d’URL à examiner, sans imposer leur traitement au moteur.
Google utilise encore lastmod sous certaines conditions
Google ne tient plus compte des champs <priority> et <changefreq>. Leur utilisation s’est révélée peu fiable, car de nombreux sites attribuaient une priorité maximale ou une fréquence élevée à toutes leurs pages. En pratique, priority et changefreq sont ignorés.
Le champ <lastmod> reste pris en compte lorsque ses valeurs paraissent cohérentes. La date de dernière modification doit correspondre à un changement significatif de la page. Si toutes les URL reçoivent systématiquement la date du jour, Google peut cesser d’utiliser cette information. Mueller précise que ce comportement ne relève pas d’une sanction antispam.
Le fichier doit aussi contenir les versions canoniques des URL, sans paramètres de suivi ni horodatage ajouté à leur adresse. Leur présence dans le sitemap constitue l’un des signaux dont Google peut tenir compte pour choisir une URL canonique.
Les flux RSS complètent les sitemaps XML
Un flux RSS répertorie principalement les URL récemment modifiées, avec leur date de publication ou d’actualisation. Google autorise sa soumission dans Search Console comme un sitemap.
Le flux RSS ne couvre généralement que les dernières publications. Il complète donc le fichier XML, qui peut contenir l’ensemble des pages indexables. Sur un site doté de nombreux sitemaps, le flux permet au moteur d’identifier directement les contenus récents.
Un sitemap XML peut contenir 50 000 URL par fichier et peser jusqu’à 50 Mo avant compression. Lorsque ces limites sont atteintes, le site peut utiliser un index de sitemaps. Cet index doit renvoyer vers des fichiers de sitemaps, sans contenir un autre index.
HTML et llms.txt ne remplacent pas le sitemap
Un sitemap HTML rassemble des liens destinés aux visiteurs. Les moteurs peuvent les suivre comme les autres liens d’une page, mais ce format ne remplace pas le XML et ne peut pas être soumis comme tel dans Search Console.
Le fichier llms.txt repose pour sa part sur du Markdown. Il présente généralement une sélection de liens vers les principales rubriques ou ressources d’un site. Google ne le traite actuellement pas comme un sitemap et ne recommande pas de compter sur une éventuelle prise en charge future.
John Mueller indique avoir observé l’accès des crawlers IA à ses sitemaps et à ses flux RSS dans ses journaux serveur. Il précise ne pas savoir comment ces fichiers sont ensuite utilisés par les systèmes concernés.
« Impossible de récupérer » ne signale pas toujours un fichier incorrect
Search Console peut afficher le message « Impossible de récupérer » pour un fichier pourtant valide, accessible publiquement et déclaré dans le fichier robots.txt.
John Mueller cite d’abord la charge du serveur. Les systèmes de Google peuvent consacrer leurs ressources à d’autres URL et ne pas disposer de capacité pour télécharger le sitemap au moment prévu.
La seconde explication concerne la demande de crawl. Lorsque les systèmes de Google estiment qu’ils n’ont pas besoin d’explorer davantage un site, ils peuvent différer la lecture du fichier. Mueller ajoute que cette demande dépend notamment de la qualité globale perçue par Google. Le message ne désigne donc pas nécessairement une erreur de syntaxe dans le XML.




