Über XML-Sitemaps
Was ist eine XML-Sitemap?
Eine XML-Sitemap ist eine maschinenlesbare Liste der Seiten einer Website, über die Suchmaschinen Bescheid wissen sollen, in der Regel mit Angaben dazu, wann jede Seite zuletzt geändert wurde. Sie wird für Crawler und nicht für Menschen erstellt, weshalb sie wie eine Datendatei und nicht wie eine Webseite aussieht.
Sie ist ein Hinweis, keine Anweisung. Das Auflisten einer Seite garantiert nicht, dass sie indexiert wird, und das Weglassen einer Seite verhindert dies nicht. Eine Sitemap beseitigt das Problem der Auffindbarkeit: Anstatt Ihre Seiten über Links zu finden und darauf zu hoffen, dass der Pfad kurz genug ist, erhält ein Crawler die Liste direkt.
Ein XML-Sitemap-Prüfer beantwortet die erste lohnende Frage, nämlich schlicht, ob eine Sitemap vorhanden und auffindbar ist. Bei überraschend vielen Websites gibt es eine Sitemap, auf die nirgendwo verwiesen wird und die noch kein Crawler jemals angefordert hat.
Sind XML-Sitemaps im Jahr 2026 noch relevant?
Für eine kleine, gut verlinkte Website bringen sie wenig – und das sollte man offen sagen. Suchmaschinen können Links gut folgen, und eine Website mit fünfzehn Seiten stellt keine besondere Herausforderung bei der Auffindbarkeit dar.
Für alles andere bleiben sie aus drei klaren Gründen wertvoll. Große Websites haben Seiten, die so tief verborgen sind, dass sie nicht zeitnah gecrawlt werden können, Websites mit häufigen Veröffentlichungen müssen neue Inhalte schnell erkannt bekommen, und jede Website mit Archiven hat Seiten, die keine internen Links mehr erhalten, aber dennoch indexiert werden sollten.
Außerdem sind sie das günstigste verfügbare Diagnosemittel. Der Vergleich der Anzahl der eingereichten URLs mit der Anzahl der indexierten URLs macht Probleme sichtbar, die nichts anderes so deutlich aufzeigt.
Wie Sitemaps mit der KI-Suche zusammenhängen
KI-Crawler stehen vor demselben Auffindbarkeitsproblem wie Suchmaschinen-Crawler, und eine Sitemap ist dieselbe Abkürzung. Inhalte, die durch das Folgen von Links nur schwer erreichbar sind, gelangen möglicherweise nie in den Datenbestand, auf den ein Modell zurückgreift.
Das Datum der letzten Änderung hat hier mehr Gewicht als früher. Aktualität ist ein starkes Signal, wenn ein System zwischen mehreren Quellen zu einem sich verändernden Thema auswählt, und ein genaues Änderungsdatum gehört zu den wenigen Angaben zur Herkunft, die eine Website direkt machen kann.
Dadurch wird ein ehrlicher Umgang mit diesen Datumsangaben wertvoller, als sie aktuell zu halten. Eine Website, die bei jedem Build jedes Datum zurücksetzt, bringt Crawlern bei, das Feld vollständig zu ignorieren.
Best Practices für Sitemaps
- Nehmen Sie nur kanonische, indexierbare URLs auf, die den Status 200 zurückgeben.
- Lassen Sie Weiterleitungen, blockierte Seiten und alles mit der Kennzeichnung „noindex“ weg; widersprüchliche Signale werden ignoriert.
- Halten Sie die Angaben zum letzten Änderungsdatum korrekt, anstatt sie bei jeder Bereitstellung zurückzusetzen.
- Teilen Sie die Sitemap in mehrere Dateien auf und verwenden Sie einen Index, sobald Sie mehr als 50.000 URLs oder 50 MB unkomprimierte Daten haben.
- Verweisen Sie in der robots.txt auf die Sitemap und reichen Sie sie in der Search Console ein.
- Generieren Sie sie neu, wenn sich die Website strukturell ändert – nicht nur beim Launch und danach nie wieder.
Was dieses Tool prüft
Das Tool sucht nach einer XML-Sitemap für die Domain und zeigt einen Erfolg an, wenn es eine Sitemap mit URLs findet.
Es bestätigt das Vorhandensein und nicht die Korrektheit. Daher wird auch eine Sitemap mit Weiterleitungen, blockierten Seiten oder Adressen, die nicht mehr existieren, als gültig eingestuft. Ob die Inhalte tatsächlich korrekt sind, ist eine separate und durchaus wichtige Frage.
Wie es weitergeht
Das Auffinden einer Sitemap ist der erste von drei Schritten. Überprüfen Sie mit dem
XML-Sitemap-Validator, ob ihr Inhalt korrekt formatiert ist, erstellen oder aktualisieren Sie die Datei mit dem
XML-Sitemap-Generator und stellen Sie sicher, dass Ihre
robots.txt-Datei Crawler auf sie verweist.