Om XML-sitemaps
Hvad er et XML-sitemap?
Et XML-sitemap er en maskinlæsbar liste over siderne på et website, som du ønsker, at søgemaskinerne skal kende til, normalt med oplysninger om, hvornår hver side senest blev ændret. Det er skrevet til crawlere og ikke til mennesker, hvilket er grunden til, at det ligner en datafil i stedet for en side.
Det er et tip, ikke en instruktion. At angive en side garanterer ikke, at den bliver indekseret, og at udelade en side forhindrer det ikke. Et sitemap løser problemet med at opdage sider: I stedet for at finde dine sider ved at følge links og håbe på, at stien er kort nok, får en crawler overdraget listen. En XML-sitemapgenerator opretter denne liste ved at crawle dit websted på samme måde som en søgemaskine, hvilket også har den nyttige sideeffekt, at du kan se, hvilke sider der faktisk er tilgængelige.
Det sidste punkt er værd at dvæle ved. En side, der mangler i et genereret sitemap, mangler som regel, fordi der ikke er noget, der linker til den, og en forældreløs side er et problem, som sitemappet ikke kan løse på egen hånd.
Har XML-sitemaps stadig betydning i 2026?
For et lille websted med gode interne links tilfører de ikke meget. Søgemaskiner er gode til at følge links, og et websted med femten sider er ikke en udfordring, når det gælder om at finde siderne.
Til alt andet er de stadig værdifulde, og det skyldes tre forskellige grunde. Store websteder har sider, der ligger så dybt, at de ikke kan crawles hurtigt. Websteder, der publicerer ofte, har brug for, at nyt indhold bliver opdaget hurtigt. Og ethvert websted med arkiver har sider, der ikke længere modtager interne links, men som stadig fortjener at blive indekseret.
De er også det billigste tilgængelige diagnosticeringsværktøj. En sammenligning af antallet af indsendte URL'er med antallet af indekserede URL'er afslører problemer, som intet andet gør lige så tydeligt. Det er ofte grund nok til at køre en XML-sitemapgenerator, selv på et websted, der ikke strengt taget har brug for en.
Sådan hænger sitemaps sammen med AI-søgning
AI-crawlere står over for det samme opdagelsesproblem som søgecrawlere, og et sitemap er den samme genvej. Indhold, der er svært at nå ved at følge links, er indhold, som måske aldrig kommer med i det datasæt, en model trækker på.
Datoerne for seneste ændring vejer tungere her, end de gjorde tidligere. Aktualitet er et stærkt signal, når et system vælger mellem flere kilder om et emne, der ændrer sig, og en nøjagtig ændringsdato er en af de få oplysninger om oprindelse, som et websted kan angive direkte.
Det gør ærlighed om disse datoer mere værdifuld end at holde dem aktuelle. Et website, der nulstiller alle datoer ved hver build, fortæller crawlerne ingenting og lærer dem at ignorere feltet.
Bedste praksis for sitemaps
- Medtag kun kanoniske, indekserbare URL’er, der returnerer statuskoden 200.
- Udelad omdirigeringer, blokerede sider og alt, der er markeret som noindex; modstridende signaler bliver ignoreret.
- Sørg for, at datoerne for seneste ændring er korrekte, i stedet for at nulstille dem ved hver deployment.
- Opdel i flere filer med et indeks, når du overskrider 50.000 URL’er eller 50 MB ukomprimeret.
- Henvis til sitemapet fra robots.txt, og indsend det i Search Console.
- Generér det igen, når webstedets struktur ændres – ikke kun ved lanceringen og aldrig igen.
Almindelige fejl
- Angivelse af URL'er, der viderestiller, hvilket spilder crawlressourcer og gør det kanoniske billede uklart.
- Inkludering af noindexerede sider, hvilket beder en crawler om at hente noget, du har bedt den om at ignorere.
- Blanding af protokoller eller værtsnavne, så sitemapet ikke stemmer overens med dine kanoniske URL'er.
- Lad det blive forældet, indtil det beskriver en webstedsstruktur, der ikke længere eksisterer.
- At betragte indsendelse som målet. Et indsendt sitemap, der aldrig kontrolleres mod indeksdækningen, fortæller dig ingenting.
Brug af XML-sitemapgeneratoren
Indtast dit domæne, hvorefter værktøjet crawler webstedet og følger links for at opbygge en liste over tilgængelige sider. Derefter genererer det en standardkompatibel XML-fil, som du kan downloade og uploade til roden af dit domæne.
Læs resultaterne, før du offentliggør dem. Sider, du forventede at finde, men ikke kan se, er som regel forældreløse sider, og sider, du ikke forventede, er ofte dubletter, der er opstået på grund af parametre eller paginering. Begge dele bør løses ved kilden i stedet for at blive redigeret ud af filen, eftersom sitemapet er et symptom på webstedets struktur og ikke en erstatning for den.
Hvad kan du gøre som det næste