Eine XML-Sitemap ist eine Liste der URLs, die Sie indexiert haben wollen – nicht mehr. Sie ersetzt keine interne Verlinkung und garantiert keine Indexierung, aber sie sagt Google, welche Seiten existieren und wann sie sich zuletzt geändert haben. Gerade bei neuen Sites, großen Sites und Sites mit schlechter Verlinkung ist das der Unterschied zwischen „in Tagen gefunden“ und „in Monaten“.
Was in die XML-Sitemap gehört
- Alle Seiten, die in der Suche erscheinen sollen: Startseite, Kategorien, Produkte, Artikel, Landingpages.
- Nur die kanonische Version jeder URL – kein http und https, kein mit und ohne Slash.
- Nur Seiten mit Status 200, die nicht per noindex oder robots.txt gesperrt sind.
Was nicht hinein gehört
- Tag-Archive, Autorenseiten, Paginierung, Suchergebnisseiten, Filter-URLs.
- Weiterleitungen, 404-Seiten, Login- und Warenkorbseiten.
- Seiten mit noindex – das widerspricht sich und kostet Vertrauen.
Die Faustregel: Wenn eine Seite kein Suchergebnis sein sollte, hat sie in der XML-Sitemap nichts verloren. Der XML-Sitemap-Generator prüft URLs auf Status und Duplikate, bevor er die Datei baut.
Limits und Aufbau
Maximal 50.000 URLs und 50 MB unkomprimiert pro Datei; darüber ein Sitemap-Index, der auf mehrere Sitemaps zeigt. Sinnvoll ist die Aufteilung nach Typ (Seiten, Beiträge, Produkte, Bilder) – so sieht man in der Search Console sofort, welcher Bereich Probleme hat. WordPress mit Yoast oder Rank Math erzeugt genau diese Struktur automatisch unter /sitemap_index.xml.
lastmod: die einzige Angabe, die Google nutzt
<lastmod> mit echtem Änderungsdatum hilft Google, geänderte Seiten zuerst zu crawlen. <priority> und <changefreq> ignoriert Google weitgehend. Wichtig: lastmod nur ändern, wenn sich der Inhalt geändert hat – wer bei jedem Build das heutige Datum setzt, entwertet das Signal.
Den Sitemap-Bericht lesen
Search Console → Sitemaps: „Erfolgreich“ heißt nur, dass die Datei lesbar ist. Entscheidend ist der Vergleich „gefundene URLs“ gegen „indexierte URLs“ unter Seiten: Liegt die Indexierung deutlich unter der Sitemap-Zahl, gibt es Qualitäts- oder Duplikatprobleme. „Gecrawlt – zurzeit nicht indexiert“ ist das Signal für dünne Inhalte; „Duplikat, vom Nutzer nicht als kanonisch festgelegt“ für fehlende Canonical-Tags.
Häufige Fragen
Muss die Sitemap in der robots.txt stehen?
Nein, aber die Zeile Sitemap: https://…/sitemap_index.xml hilft Bing und anderen Suchmaschinen, sie zu finden. Der robots.txt-Generator setzt sie automatisch.
Wie oft liest Google die Sitemap?
Bei aktiven Sites täglich; nach Einreichung in der Search Console innerhalb von Stunden.
Brauchen Bilder eine eigene Sitemap?
Nur, wenn Bilder per JavaScript geladen werden oder Bildersuche ein Ziel ist; sonst reicht die Einbettung in normalen Seiten.
Kostenlos, läuft im Browser, nichts wird hochgeladen, keine Anmeldung.
Weiterlesen
Mehr aus SEO- & Website-Tools.


