
Een XML-sitemap lijst de URL’s van een site op om hun vindbaarheid door zoekmachines te vergemakkelijken. Google herinnert hieraan in zijn documentatie: dit bestand helpt bij het vinden van URL’s, maar garandeert noch verkenning noch indexering. Het meten van het verschil tussen wat een sitemap belooft en wat het daadwerkelijk produceert, stelt ons in staat om de technische inspanning die eraan besteed moet worden, te kalibreren.
XML-sitemap en HTML-sitemap: twee bestanden, twee verschillende functies
De verwarring tussen XML-sitemap en HTML-sitemap blijft bestaan. Hun rollen, hun ontvangers en hun SEO-impact verschillen op verschillende punten.
| Criteria | XML-sitemap | HTML-sitemap |
|---|---|---|
| Hoofdontvanger | Indexeringsrobots (Googlebot, Bingbot) | Menselijke bezoekers |
| Formaat | .xml-bestand geplaatst in de root van de site | Webpagina toegankelijk via het menu of de footer |
| Inhoud | Lijst van URL’s met metadata (wijzigingsdatum, frequentie) | Klikbare hiërarchie van pagina’s |
| Impact op crawl | Geeft prioriteit aan te verkennen URL’s | Geen directe invloed op de crawl van robots |
| Impact op gebruikerservaring | Geen (bestand niet bedoeld voor bezoekers) | Helpt bij navigatie, vooral op grote sites |
| Onderhoud | Automatiseerbaar via CMS of pipeline | Vaak handmatig of semi-automatisch |
De XML-sitemap blijft het referentieformaat in SEO. De HTML-sitemap kan de interne linkstructuur aanvullen, maar vervangt geen correct gestructureerd XML-bestand. Op de sitemap-pagina van Pimp Your Biz zien we een concreet voorbeeld van een XML-bestand dat per sectie is opgesomd, wat de logica van segmentatie per type inhoud goed illustreert.

Indexeerbare URL’s in de sitemap: het filter dat het signaal naar Google verandert
Het opsommen van alle URL’s van een site in de sitemap is een veelvoorkomende fout. Een bestand dat 301-omleidingen, pagina’s in noindex, 404-fouten of varianten met parameters bevat, stuurt een verstoord signaal naar de robots. Google moet dan zelf sorteren wat de moeite waard is om te verkennen.
Alleen canonieke en indexeerbare URL’s hebben hun plaats in de sitemap. Dit filterprincipe transformeert het bestand in een betrouwbare inventaris in plaats van een technische dump.
URL’s die systematisch moeten worden uitgesloten
- Omgeleide pagina’s (301, 302): ze verwijzen naar een andere URL, het opnemen ervan creëert een onnodige lus voor de robot
- Pagina’s in noindex: hun aanwezigheid in de sitemap is in strijd met de meta-robotsrichtlijn en genereert een technische inconsistentie
- URL’s met sorteer-, filter- of sessieparameters: ze dupliceren de inhoud van een canonieke pagina zonder toegevoegde waarde voor indexering
- Pagina’s met fout 404 of 410: ze verspillen het crawl-budget op niet-bestaande bronnen
Een e-commerce site met duizenden productpagina’s illustreert het probleem goed. Zonder filter kan de sitemap meerdere keren hetzelfde product onder verschillende URL’s bevatten (sorteren op prijs, kleur, maat). De robot verkent dan tientallen varianten in plaats van zich te concentreren op de canonieke pagina.
Automatiseer de generatie van de sitemap om veroudering te voorkomen
Een handmatig onderhouden sitemap wordt verouderd zodra het publicatietempo meer dan enkele pagina’s per maand overschrijdt. Automatisering via het CMS of een implementatiepipeline is de huidige beste praktijk voor sites die regelmatig publiceren.
Op WordPress genereren extensies zoals Yoast SEO of Rank Math de XML-sitemap bij elke publicatie of update van inhoud. Het bestand weerspiegelt dan de werkelijke staat van de site zonder menselijke tussenkomst.
Gespecialiseerde sitemaps voor rijke inhoud
Google staat toe om verschillende soorten inhoud in sitemaps te declareren, naast de klassieke HTML-pagina’s. Sites met veel media profiteren van het segmenteren van hun bestanden.
- Afbeeldingssitemap: nuttig voor portfolio’s, e-commerce sites of beeldbanken. Elke afbeelding die aan een URL is gekoppeld, kan worden gedeclareerd met zijn titel en bijschrift
- Video-sitemap: relevant voor sites die native video-inhoud hosten. De metadata (duur, beschrijving, miniatuur) helpen Google om rich snippets weer te geven
- Nieuws-sitemap: gereserveerd voor uitgevers die zijn opgenomen in Google Nieuws, met een geldigheidsperiode van enkele dagen na publicatie
Een gesegmenteerde sitemap per type inhoud vergemakkelijkt de technische diagnose. Als de indexering van video’s problemen vertoont, stelt het specifieke bestand in staat om de oorzaak te isoleren zonder het hele aantal URL’s van de site te doorlopen.

Dien de sitemap in en houd deze in de gaten in Google Search Console
De sitemap in het robots.txt-bestand declareren via de richtlijn Sitemap: https://example.com/sitemap.xml blijft de referentiemethode. Alle compatibele robots detecteren het automatisch tijdens de crawl.
Actieve indiening via Google Search Console biedt een extra niveau van informatie. De interface toont het aantal gedetecteerde URL’s, het aantal geïndexeerde URL’s en eventuele leesfouten van het bestand. Het verschil tussen ingediende URL’s en geïndexeerde URL’s is een directe indicator van de kwaliteit van de sitemap.
Lezing van het verschil tussen ingediende en geïndexeerde URL’s
Een klein verschil betekent dat het bestand alleen relevante URL’s bevat in de ogen van Google. Een groot verschil (de meerderheid van de ingediende URL’s zijn niet geïndexeerd) wijst op een probleem met de kwaliteit van de inhoud, duplicatie of tegenstrijdige richtlijnen.
Dit verschil wordt niet gecorrigeerd door de sitemap opnieuw in te dienen. Het is nodig om de uitgesloten pagina’s te analyseren, de reden voor de afwijzing te begrijpen (dunne inhoud, noindex, canoniek naar een andere URL) en het bestand dienovereenkomstig op te schonen.
De sitemap versnelt de indexering niet mechanisch. Het structureert de dialoog tussen een site en de robots, op voorwaarde dat het alleen URL’s bevat die het waard zijn om te worden verkend. De echte maatstaf voor de effectiviteit ervan is te zien in Google Search Console, in de verhouding tussen wat we indienen en wat Google onthoudt.