Een XML-sitemap is nutteloos als deze URL’s bevat die Google niet moet indexeren. We zien regelmatig sitemapbestanden vol met 301-omleidingen, pagina’s met noindex of gedupliceerde URL-parameters, wat het crawlbudget verwatert in plaats van het te concentreren. De navigatie van een site optimaliseren via de sitemap begint met het schoonmaken van dit bestand, zodat er alleen canonieke, indexeerbare en actuele URL’s overblijven.
Betrouwbaarheid van lastmod: het enige XML-signaal dat Google nog gebruikt
De <priority> en <changefreq> tags worden door Google genegeerd. We raden aan om deze uit het bestand te verwijderen om de leesbaarheid te verbeteren. De enige XML-parameter die daadwerkelijk het gedrag van de crawler beïnvloedt, is <lastmod> met een echte wijzigingsdatum.
Een betrouwbare lastmod datum betekent dat deze overeenkomt met een significante wijziging van de inhoud, gestructureerde gegevens of interne links van de pagina. Het automatisch regenereren van de sitemap elke nacht door alle datums bij te werken, is geen relevant signaal. Google vergelijkt de aangegeven datum met de werkelijke inhoud van de pagina: als er niets is veranderd, daalt het vertrouwen in het bestand algemeen.
Bing gaat verder en gebruikt lastmod als versheidsignaal in zijn zoeksystemen, ook voor door AI ondersteunde ervaringen. Een sitemap met betrouwbare datums verbetert dus de zichtbaarheid op beide belangrijkste zoekmachines. Om te observeren hoe een site zijn URL’s daadwerkelijk structureert in een sitemapbestand, de sitemap pagina van Soupir illustreert goed een indeling per thematische secties.
Sitemap XML en crawlbudget: wat uit te sluiten

De eerste reflex die je moet aannemen, is om de inhoud van de sitemap te vergelijken met de indexeringsdekking in Google Search Console. URL’s die fouten vertonen (404, soft 404, omleidingen) of de status “geëxploreerd, niet geïndexeerd” hebben niets te zoeken in het bestand.
Hier zijn de categorieën URL’s die systematisch uitgesloten moeten worden:
- Omgeleide pagina’s (301 of 302): de sitemap moet naar de uiteindelijke bestemming wijzen, niet naar de bron-URL van de omleiding
- URL’s met sorteer-, filter- of pagineringparameters die gedupliceerde inhoud genereren zonder de juiste canonical tag
- Pagina’s beschermd door een
noindexof geblokkeerd in de robots.txt, aangezien hun aanwezigheid in de sitemap een tegenstrijdig signaal naar de crawler stuurt - Verouderde bronnen (uitverkochte productpagina’s, gedeactiveerde artikelen) die geen nuttige inhoud meer teruggeven
Een sitemap mag alleen indexeerbare en actuele URL’s bevatten. Elke overbodige invoer verbruikt crawlbudget zonder rendement. Op een site met duizenden pagina’s maakt deze hygiëne een meetbaar verschil in de snelheid van indexering van nieuwe inhoud.
Sitemap index en segmentatie per type inhoud
Bij een bepaald volume pagina’s wordt een enkel bestand moeilijk te onderhouden en te analyseren. De specificatie van het sitemapprotocol staat indexbestanden toe die meerdere kind-sitemaps refereren. We raden aan om te segmenteren op type inhoud in plaats van op alfabetische volgorde of op datum van creatie.
Een effectieve indeling scheidt redactionele pagina’s (artikelen, gidsen), product- of dienstpagina’s, categoriepagina’s en media (afbeeldingen, video’s). Deze segmentatie maakt het mogelijk om snel te identificeren welk subset problemen vertoont in Search Console. Als het indexeringspercentage van productpagina’s daalt, kan de diagnose in enkele seconden worden gesteld in plaats van een monolithisch bestand door te spitten.
Gespecialiseerde sitemaps voor afbeeldingen en video’s verdienen bijzondere aandacht. Een afbeeldingssitemap verrijkt met de tags <image:loc> en <image:title> vergemakkelijkt de indexering in Google Afbeeldingen. Voor video zorgen de tags <video:thumbnail_loc>, <video:title> en <video:description> ervoor dat ze verschijnen in de verrijkte resultaten. Deze gespecialiseerde sitemaps worden onderbenut op de meeste sites die we auditen.

IndexNow en indiening van de sitemap: de twee benaderingen combineren
Het indienen van je sitemap via Google Search Console en Bing Webmaster Tools blijft de referentiemethode voor de initiële ontdekking van URL’s. De verklaring in het robots.txt-bestand (Sitemap: https://example.com/sitemap.xml) zorgt ervoor dat elke crawler die zich aan het protocol houdt, het bestand zonder extra configuratie kan vinden.
Voor Bing, de IndexNow-protocol aanvult de sitemap bij incidentele wijzigingen. In plaats van te wachten tot de crawler de sitemap opnieuw bezoekt, meldt IndexNow in realtime aan de motor dat een URL is toegevoegd, gewijzigd of verwijderd. Deze melding mag niet herhaaldelijk worden verzonden voor ongewijzigde pagina’s, om te voorkomen dat de geloofwaardigheid bij het systeem verloren gaat.
De combinatie werkt als volgt: de XML-sitemap dekt de volledige site en fungeert als een vangnet voor grootschalige ontdekking, terwijl IndexNow de verwerking van urgente updates versnelt. Google heeft IndexNow niet aangenomen, maar zijn indexerings-API biedt een vergelijkbaar mechanisme voor in aanmerking komende inhoudstypes.
Sitemap HTML en interne linkstructuur: twee complementaire tools
Een zichtbare HTML-sitemap voor bezoekers vervangt de XML-bestand niet, maar versterkt de interne linkstructuur. Elke link in een HTML-sitemap geeft PageRank door naar de diepere pagina’s die de hoofdnav van de site niet altijd dekt.
Om deze pagina nuttig te maken en geen gewoon plat register te zijn, moet deze de werkelijke hiërarchie van de site weerspiegelen. Het groeperen van links per categorie, met een dieptebeperking van twee of drie niveaus, geeft zowel de bezoeker als de crawler een leesbare kaart van de structuur.
Een sitemap, of het nu XML of HTML is, is geen statisch document. De frequentie van updates moet het publicatietempo van de site volgen. Een verouderd XML-bestand dat dode URL’s verwijst, schaadt het vertrouwen van de crawler in het hele domein. Het handhaven van deze consistentie tussen de sitemap en de werkelijke staat van de site blijft de eerste voorwaarde zodat het hulpmiddel daadwerkelijk de navigatie en indexering dient.



