Un sitemap est un fichier XML qui liste les URL d’un site web pour indiquer aux robots d’exploration quelles pages existent et méritent d’être parcourues. Pour un site dédié à la nature, où les contenus mêlent fiches espèces, sentiers de randonnée, galeries photo et articles saisonniers, ce fichier devient un outil de pilotage technique à part entière.
Balises XML du sitemap : ce que Google utilise vraiment
La structure d’un fichier sitemap repose sur quelques balises encadrées par le protocole sitemaps.org. Trois d’entre elles reviennent dans la majorité des guides : loc (l’URL), lastmod (date de dernière modification), priority et changefreq.
Google ignore les balises priority et changefreq. Ces deux champs, encore fréquemment recommandés dans les articles généralistes, ne constituent pas un axe d’optimisation. La seule métadonnée exploitée en complément de l’URL reste lastmod, et uniquement si la date correspond à une modification réelle du contenu. Indiquer une date de mise à jour fictive pour « forcer » un nouveau passage du robot n’a aucun effet positif.
Pour un site nature, la balise lastmod prend tout son sens sur les pages mises à jour selon les saisons : calendrier de floraison, périodes d’observation ornithologique, conditions d’accès à un sentier. Lorsqu’une fiche est réellement actualisée (nouvelles données, correction d’un statut de protection), la date lastmod doit refléter ce changement. Les articles publiés une fois et jamais retouchés peuvent conserver leur date initiale sans problème.
Un exemple concret de structuration se retrouve sur la page sitemap de Exp Nature, qui organise ses URL par types de contenus liés à la faune, la flore et les activités de terrain.

Sitemap et indexation : une aide à la découverte, pas une garantie
Un malentendu persiste : soumettre un sitemap à Google Search Console ne garantit ni l’exploration ni l’indexation des URL listées. Google présente le sitemap comme un moyen de découvrir plus facilement les pages, pas comme un ordre d’indexation.
Cette distinction change la façon d’évaluer l’efficacité du fichier. Compter le nombre d’URL « envoyées » dans Search Console ne suffit pas. L’indicateur pertinent est l’écart entre le nombre d’URL présentes dans le sitemap et le nombre d’URL effectivement indexées, visible dans le rapport « Pages » de Search Console.
Un écart significatif entre ces deux valeurs peut révéler plusieurs problèmes techniques :
- Des pages marquées en noindex par erreur, souvent à cause d’un plugin SEO mal configuré ou d’un environnement de staging dont les directives ont été conservées en production.
- Des problèmes de canonicalisation, lorsque plusieurs URL pointent vers un contenu similaire et que Google choisit une version différente de celle déclarée dans le sitemap.
- Des redirections en chaîne ou des erreurs serveur (codes 3xx, 4xx, 5xx) qui empêchent le robot d’accéder à la page finale.
Le statut « Découverte, actuellement non indexée » dans Search Console ne signifie pas que le sitemap est mal configuré. Il indique simplement que Google a repéré l’URL mais n’a pas encore planifié son exploration, parfois pour des raisons de budget de crawl.
Structurer un sitemap pour un site web nature
Un site nature accumule des types de contenus très différents : articles de blog, fiches descriptives, galeries d’images, cartes interactives, pages d’événements. Tout regrouper dans un seul fichier XML fonctionne pour les petits sites, mais devient vite illisible au-delà de quelques centaines de pages.
Le sitemap index pour segmenter par thématique
La solution consiste à créer un fichier sitemap index qui référence plusieurs sitemaps secondaires. Chaque sitemap secondaire correspond à un type de contenu : un pour les fiches espèces, un pour les articles de blog, un pour les galeries photo.
Cette segmentation permet de repérer immédiatement quel type de contenu pose problème à l’indexation. Si le sitemap « fiches espèces » affiche un taux d’indexation faible alors que le sitemap « articles » fonctionne bien, le diagnostic se concentre sur la structure des fiches.
Exclure les pages inutiles du sitemap
Un sitemap efficace ne liste que les pages destinées à être indexées. Les pages de résultats de recherche interne, les pages de tags générées automatiquement, les archives par date ou les pages de pagination n’ont généralement pas vocation à apparaître dans les résultats de Google.
Sur un site nature sous WordPress, les extensions SEO permettent d’exclure ces URL du sitemap. La règle de base : si une page n’apporte pas de valeur autonome à un visiteur qui arriverait dessus depuis un moteur de recherche, elle n’a pas sa place dans le fichier.

Soumettre et surveiller le sitemap dans Search Console
La soumission du sitemap passe par la section « Sitemaps » de Google Search Console. L’URL du fichier (souvent votresite.com/sitemap.xml ou votresite.com/sitemap_index.xml) est déclarée une seule fois. Google revient ensuite le consulter régulièrement sans intervention manuelle.
La surveillance active compte plus que la soumission initiale. Deux vérifications régulières suffisent :
- Comparer le nombre d’URL soumises au nombre d’URL indexées, chaque mois, pour détecter une dérive progressive.
- Vérifier que les nouvelles pages publiées apparaissent bien dans le sitemap, ce qui n’est pas toujours automatique selon la configuration du plugin utilisé.
- Contrôler que la date lastmod des pages modifiées se met à jour correctement, en inspectant le fichier XML brut dans un navigateur.
Un sitemap bien structuré ne remplace pas un maillage interne cohérent. Les deux mécanismes se complètent : le maillage interne guide les robots à travers la navigation du site, le sitemap leur fournit une liste de référence. Pour un site nature riche en contenus saisonniers et en fiches thématiques, cette complémentarité reste le levier technique le plus direct pour améliorer la couverture d’indexation.



