Die Sitemap ist eine Datei, die die URLs einer Website auflistet, um deren Auffindbarkeit durch Suchmaschinen zu erleichtern. Google, Bing und ihre Crawling-Bots stützen sich auf diese Datei, um eine Website systematisch zu durchsuchen. Doch die Rolle der Sitemap hat sich in den letzten Jahren weiterentwickelt, und einige ihrer technischen Felder sind zu Vertrauenssignalen geworden, anstatt nur einfache Strukturhinweise zu sein.
Das lastmod-Feld der Sitemap: ein Vertrauenssignal, das Google überwacht
Das lastmod-Tag in einer XML-Sitemap gibt das Datum der letzten Änderung einer URL an. Lange Zeit als einfacher Frischeindikator wahrgenommen, fungiert es mittlerweile als Glaubwürdigkeitsindikator für die gesamte Website.
Wenn die lastmod-Daten systematisch ungenau sind (alle identisch, alle gleich dem Erstellungsdatum der Website), neigt Google dazu, dieses Feld für die gesamte Domain zu ignorieren. Die Website verliert dann ein Mittel zur Priorisierung des erneuten Crawlings ihrer tatsächlich aktualisierten Seiten.
Eine Sitemap, deren Daten die tatsächlichen Änderungen genau widerspiegeln, lenkt die Bots auf frische Inhalte, was die Berücksichtigung der Aktualisierungen beschleunigt. Im Gegensatz dazu sendet eine “falsche” Sitemap ein verwirrtes Signal, und die Suchmaschinen wenden sich schließlich davon ab.
Man kann diese Art von Funktion beobachten, indem man die Sitemap-Seite von Le Comptoir de Violette konsultiert, die die Struktur einer Sitemap-Datei veranschaulicht, die direkt von einer Website aus zugänglich ist.
Die Tags priority und changefreq der XML-Sitemap: noch nützlich oder obsolet

Das Protokoll sitemaps.org dokumentiert weiterhin die optionalen Tags priority und changefreq. Das erste weist einen relativen Prioritätswert zwischen den URLs der Website zu. Das zweite gibt die geschätzte Änderungsfrequenz einer Seite an.
In der Praxis ignorieren die großen Suchmaschinen diese beiden Felder. Google hat dies mehrfach bestätigt: Seine Algorithmen bestimmen selbst die Crawling-Frequenz und die Indexierungspriorität, unabhängig davon, was die Sitemap-Datei angibt.
Diese Tags beizubehalten, ist nicht nachteilig, aber ihr Entfernen reduziert die Größe der Sitemap-Datei und vereinfacht deren Wartung. Für große Websites (mehrere tausend Seiten) kann diese Gewichtsreduktion einen marginalen Effekt auf die Verarbeitungsgeschwindigkeit durch die Bots haben. Die Rückmeldungen aus der Praxis sind hier unterschiedlich, einige Webmaster stellen nach dem Entfernen keinen messbaren Unterschied fest.
XML-Sitemap und KI-gestützte Suche: eine aufkommende Rolle in der Frische des Inhalts
KI-gestützte Suchumgebungen, wie die generativen Antworten von Google, legen zunehmend Wert auf die Frische des Inhalts. Die XML-Sitemap, wenn ihre lastmod-Daten zuverlässig sind, wird zu einem Signal, das diese Systeme nutzen können, um zu bestimmen, welche Seiten vorrangig zitiert werden sollten.
Dieses Phänomen ist noch neu, und die verfügbaren Daten erlauben keine Schlussfolgerungen über sein genaues Ausmaß. Die Logik ist jedoch konsistent: eine KI, die Antworten generiert, benötigt aktuelle Quellen, und die Sitemap bleibt eine der wenigen standardisierten Dateien, die das Änderungsdatum einer Seite explizit angibt.
Inhalt einer XML-Sitemap: welche URLs einfügen und welche ausschließen
Eine effektive Sitemap listet nicht alle URLs einer Website auf. Sie enthält nur die Seiten, die in den Suchergebnissen erscheinen sollen. Das Einfügen von nicht indexierbaren, umgeleiteten oder duplizierten URLs verwischt das Signal, das an die Suchmaschinen gesendet wird.
Die Filterkriterien, die vor der Erstellung oder Aktualisierung einer Sitemap angewendet werden sollten:
- URLs ausschließen, die durch die Datei robots.txt blockiert sind oder ein noindex-Tag tragen, da deren Anwesenheit in der Sitemap eine technische Widersprüchlichkeit schafft
- Seiten mit Paginierung, Datumsarchiven und Tag-Seiten ausschließen, wenn sie den Suchmaschinen keinen einzigartigen Inhalt bieten
- Umgeleitete URLs (301, 302) ausschließen: Die Sitemap sollte auf die endgültige Zieladresse verweisen, nicht auf die alte Adresse
- Nur Seiten einfügen, deren Inhalt eine Indexierung rechtfertigt, wie Artikel, Produktseiten, Hauptkategorieseiten
Eine saubere Sitemap enthält weniger URLs, sendet aber ein klareres Signal an die Crawling-Bots. Auf Websites mit mehreren hundert Seiten macht diese Bereinigung einen echten Unterschied in der Geschwindigkeit der Indexierung neuer Inhalte.

Die Sitemap einreichen und überprüfen: Google Search Console und robots.txt
Zwei ergänzende Methoden ermöglichen es, eine Sitemap bei Suchmaschinen zu deklarieren. Die erste erfolgt über die Google Search Console, wo die URL der Sitemap-Datei direkt eingereicht wird. Das Tool gibt dann einen Statusbericht zurück, der die Anzahl der entdeckten, indexierten oder fehlerhaften URLs angibt.
Die zweite Methode besteht darin, den Standort der Sitemap in der Datei robots.txt zu deklarieren, über eine Zeile wie Sitemap: https://beispiel.com/sitemap.xml. Diese Erklärung wird von allen Suchmaschinen gelesen, die mit dem Protokoll kompatibel sind, nicht nur von Google.
Die beiden Ansätze schließen sich nicht aus. Die Kombination der Einreichung über die Search Console und der Deklaration in robots.txt gewährleistet eine maximale Abdeckung. Bing Webmaster Tools bieten einen ähnlichen Mechanismus wie Google, zusätzlich mit dem IndexNow-Protokoll, das es ermöglicht, die Suchmaschinen in Echtzeit über die Veröffentlichung oder Änderung einer Seite zu benachrichtigen.
- Search Console: manuelle Einreichung, detaillierter Abdeckungsbericht, Warnungen bei Fehlern in der Sitemap
- Robots.txt: passive Deklaration, die automatisch von allen kompatiblen Crawlers gelesen wird
- IndexNow: proaktive Benachrichtigung, die mit Bing kompatibel ist und die Berücksichtigung von Aktualisierungen beschleunigt, ohne auf den nächsten geplanten Crawl zu warten
Die Sitemap bleibt eine technische Datei, deren Effizienz von der Sorgfalt abhängt, mit der sie gepflegt wird. Eine aktuelle, treue und korrekt eingereichte Sitemap garantiert keine Indexierung, bietet jedoch den Suchmaschinen die besten Bedingungen, um eine Website konsistent zu durchsuchen. Ihre Wartung zu ignorieren, bedeutet, die Bots ohne zuverlässige Orientierung navigieren zu lassen, was insbesondere große Websites oder solche mit häufig wechselndem Inhalt benachteiligt.



