Over XML-sitemaps
Wat is een XML-sitemap?
Een XML-sitemap is een machineleesbare lijst van de pagina’s op een site waarvan je wilt dat zoekmachines ze kennen, meestal voorzien van informatie over wanneer elke pagina voor het laatst is gewijzigd. De sitemap is bedoeld voor crawlers en niet voor mensen, en ziet er daarom uit als een gegevensbestand in plaats van als een pagina.
Het is een aanwijzing, geen instructie. Het opnemen van een pagina biedt geen garantie dat deze wordt geïndexeerd, en het weglaten ervan voorkomt dat evenmin. Wat een sitemap doet, is het ontdekkingsprobleem wegnemen: in plaats van je pagina’s te vinden door links te volgen en te hopen dat het pad kort genoeg is, krijgt een crawler de lijst aangereikt. Een XML-sitemapgenerator maakt die lijst door je website te crawlen zoals een zoekmachine dat zou doen. Dit heeft bovendien als nuttig neveneffect dat je kunt zien welke pagina’s daadwerkelijk bereikbaar zijn.
Dat laatste punt verdient nadere aandacht. Een pagina die ontbreekt in een gegenereerde sitemap ontbreekt daar meestal omdat er niets naar linkt, en een verweesde pagina is een probleem dat de sitemap niet zelfstandig kan oplossen.
Zijn XML-sitemaps in 2026 nog steeds relevant?
Voor een kleine, goed gelinkte website voegen ze weinig toe. Zoekmachines zijn goed in het volgen van links en een website met vijftien pagina's vormt geen uitdaging op het gebied van ontdekking.
Voor al het andere blijven ze waardevol, en wel om drie verschillende redenen. Grote sites hebben pagina's die te diep zijn begraven om snel te worden gecrawld. Sites die regelmatig publiceren, moeten ervoor zorgen dat nieuwe content snel wordt opgemerkt. En elke site met archieven heeft pagina's die geen interne links meer ontvangen, maar die nog steeds geïndexeerd zouden moeten worden.
Ze zijn bovendien het goedkoopste beschikbare diagnostische hulpmiddel. Door het aantal ingediende URL's te vergelijken met het aantal geïndexeerde URL's, komen problemen aan het licht die niets anders zo duidelijk zichtbaar maakt. Dat is vaak al reden genoeg om een XML-sitemapgenerator te gebruiken, zelfs op een site die er strikt genomen geen nodig heeft.
Hoe sitemaps zich verhouden tot AI-zoekopdrachten
AI-crawlers hebben hetzelfde ontdekkingsprobleem als zoekmachinecrawlers, en een sitemap biedt dezelfde snelkoppeling. Content die moeilijk te bereiken is door links te volgen, komt mogelijk helemaal nooit terecht in de verzameling waaruit een model put.
De datums van de laatste wijziging wegen hier zwaarder dan vroeger. Actualiteit is een sterk signaal wanneer een systeem moet kiezen uit meerdere bronnen over een onderwerp dat verandert, en een nauwkeurige wijzigingsdatum is een van de weinige gegevens over de herkomst die een site rechtstreeks kan vermelden.
Dat maakt eerlijkheid over die datums waardevoller dan ze recent houden. Een site die bij elke build elke datum opnieuw instelt, vertelt crawlers niets en leert ze het veld te negeren.
Best practices voor sitemaps
- Neem alleen canonieke, indexeerbare URL's op die een 200-status retourneren.
- Laat omleidingen, geblokkeerde pagina's en alles met de markering noindex weg; tegenstrijdige signalen worden genegeerd.
- Houd de datums voor laatste wijziging accuraat in plaats van ze bij elke deployment opnieuw in te stellen.
- Splits de sitemap op in meerdere bestanden met een index zodra je meer dan 50.000 URL's of 50 MB ongecomprimeerde data hebt.
- Verwijs vanuit robots.txt naar de sitemap en dien deze in bij Search Console.
- Genereer de sitemap opnieuw wanneer de sitestructuur verandert, niet alleen bij de lancering om er daarna nooit meer naar om te kijken.
Veelgemaakte fouten
- URL's opnemen die doorverwijzen, waardoor crawlcapaciteit wordt verspild en het beeld van de canonieke URL's onduidelijk wordt.
- Pagina's met noindex opnemen, waarmee je een crawler vraagt iets op te halen wat je hem hebt opgedragen te negeren.
- Protocollen of hostnamen door elkaar gebruiken, waardoor de sitemap niet overeenkomt met je canonieke URL's.
- De sitemap laten verouderen totdat deze een sitestructuur beschrijft die niet meer bestaat.
- Een indiening als doel op zich beschouwen. Een ingediende sitemap die nooit wordt gecontroleerd op indexdekking, vertelt je niets.
De XML-sitemapgenerator gebruiken
Voer je domein in. De tool crawlt de website en volgt links om een lijst met bereikbare pagina's samen te stellen. Vervolgens genereert de tool een XML-bestand dat voldoet aan de standaarden en dat je kunt downloaden en uploaden naar de hoofdmap van je domein.
Lees de resultaten voordat je ze publiceert. Pagina's die je verwachtte maar niet kunt zien, zijn meestal verweesde pagina's, en pagina's die je niet verwachtte zijn vaak duplicaten die door parameters of paginering zijn veroorzaakt. Beide zijn het waard om bij de bron te corrigeren in plaats van ze uit het bestand te verwijderen, omdat de sitemap een symptoom van de sitestructuur is en geen vervanging daarvoor.
Waar je nu verder kunt gaan