...
Kontakt Kontakt

XML-Sitemap erklärt: Was hinein gehört, was nicht, und wie man die Ergebnisse liest

XML Sitemaps Explained: What to Include, What to Leave Out, and How to Read the Results XML Sitemaps Explained: What to Include, What to Leave Out, and How to Read the Results

Eine XML-Sitemap ist eine Liste der URLs, die Sie indexiert haben wollen – nicht mehr. Sie ersetzt keine interne Verlinkung und garantiert keine Indexierung, aber sie sagt Google, welche Seiten existieren und wann sie sich zuletzt geändert haben. Gerade bei neuen Sites, großen Sites und Sites mit schlechter Verlinkung ist das der Unterschied zwischen „in Tagen gefunden“ und „in Monaten“.

Was in die XML-Sitemap gehört

  • Alle Seiten, die in der Suche erscheinen sollen: Startseite, Kategorien, Produkte, Artikel, Landingpages.
  • Nur die kanonische Version jeder URL – kein http und https, kein mit und ohne Slash.
  • Nur Seiten mit Status 200, die nicht per noindex oder robots.txt gesperrt sind.

Was nicht hinein gehört

  • Tag-Archive, Autorenseiten, Paginierung, Suchergebnisseiten, Filter-URLs.
  • Weiterleitungen, 404-Seiten, Login- und Warenkorbseiten.
  • Seiten mit noindex – das widerspricht sich und kostet Vertrauen.

Die Faustregel: Wenn eine Seite kein Suchergebnis sein sollte, hat sie in der XML-Sitemap nichts verloren. Der XML-Sitemap-Generator prüft URLs auf Status und Duplikate, bevor er die Datei baut.

Limits und Aufbau

Maximal 50.000 URLs und 50 MB unkomprimiert pro Datei; darüber ein Sitemap-Index, der auf mehrere Sitemaps zeigt. Sinnvoll ist die Aufteilung nach Typ (Seiten, Beiträge, Produkte, Bilder) – so sieht man in der Search Console sofort, welcher Bereich Probleme hat. WordPress mit Yoast oder Rank Math erzeugt genau diese Struktur automatisch unter /sitemap_index.xml.

Advertisement

lastmod: die einzige Angabe, die Google nutzt

<lastmod> mit echtem Änderungsdatum hilft Google, geänderte Seiten zuerst zu crawlen. <priority> und <changefreq> ignoriert Google weitgehend. Wichtig: lastmod nur ändern, wenn sich der Inhalt geändert hat – wer bei jedem Build das heutige Datum setzt, entwertet das Signal.

Den Sitemap-Bericht lesen

Search Console → Sitemaps: „Erfolgreich“ heißt nur, dass die Datei lesbar ist. Entscheidend ist der Vergleich „gefundene URLs“ gegen „indexierte URLs“ unter Seiten: Liegt die Indexierung deutlich unter der Sitemap-Zahl, gibt es Qualitäts- oder Duplikatprobleme. „Gecrawlt – zurzeit nicht indexiert“ ist das Signal für dünne Inhalte; „Duplikat, vom Nutzer nicht als kanonisch festgelegt“ für fehlende Canonical-Tags.

Häufige Fragen

Muss die Sitemap in der robots.txt stehen?

Nein, aber die Zeile Sitemap: https://…/sitemap_index.xml hilft Bing und anderen Suchmaschinen, sie zu finden. Der robots.txt-Generator setzt sie automatisch.

Wie oft liest Google die Sitemap?

Bei aktiven Sites täglich; nach Einreichung in der Search Console innerhalb von Stunden.

Brauchen Bilder eine eigene Sitemap?

Nur, wenn Bilder per JavaScript geladen werden oder Bildersuche ein Ziel ist; sonst reicht die Einbettung in normalen Seiten.

Jetzt ausprobieren: XML-Sitemap-Generator

Kostenlos, läuft im Browser, nichts wird hochgeladen, keine Anmeldung.

Tool öffnen →
Add a comment Add a comment

Leave a Reply

Your email address will not be published. Required fields are marked *

Submit Comment

Advertisement
Seraphinite AcceleratorOptimized by Seraphinite Accelerator
Turns on site high speed to be attractive for people and search engines.