Sitemap-Generator

sitemap.xml Generator

Geben Sie eine URL-Liste ein, legen Sie changefreq, priority und lastmod global fest, und generieren Sie sitemap.org-konforme XML-Sitemaps mit einem Klick.

Eingabe & Parameter
XML-Ausgabe
3 gültige URLs, 483 Bytes

Generieren Sie online Sitemap-XML-Website-Map-Dateien gemäß dem offenen sitemap.org 0.9-Protokollstandard. Unterstützt die vollständige Konfiguration von sieben changefreq-Aktualisierungsfrequenzen, priority 0.0-1.0 relativer Priorität und lastmod-Datumswähler. Bietet automatisches XML-Entitäts-Escaping, Echtzeiterkennung ungültiger URLs, strukturierte XML-Echtzeitvorschau, Ein-Klick-Download und Kopierfunktionen. Hilft führenden Suchmaschinen wie Google und Bing, alle wichtigen Seiten Ihrer Website schnell zu entdecken und effizient zu indexieren.

Ähnliche Tools

Anwendungsfälle

  • Generieren Sie nach dem Launch einer neuen Website Batch-Sitemaps für Kernseiten und übermitteln Sie sie an Google Search Console und Bing Webmaster Tools, um die Entdeckung und Indexierung durch Suchmaschinen zu beschleunigen
  • Generieren Sie nach Website-Relaunches oder URL-Strukturanpassungen die Sitemap neu, aktualisieren Sie den Suchmaschinenindex, um zu verhindern, dass tote Links die SEO-Leistung beeinträchtigen
  • Importieren Sie bei E-Commerce-Websites Batch-Produktlisten-URLs und legen Sie unterschiedliche changefreq- und priority-Werte nach Produktkategorie und Veröffentlichungszeit fest
  • Teilen Sie bei großen Portalen oder Nachrichtenseiten mit mehr als 50.000 URLs die Sitemaps nach Kanälen auf und erstellen Sie eine Sitemap-Index-Datei
  • Konfigurieren Sie auf Blog-Websites angemessene Aktualisierungsfrequenzen und Prioritätsparameter für Artikelseiten, Tag-Seiten, Kategorieseiten und Archivseiten
  • Ordnen Sie auf Unternehmenswebsites verschiedene URL-Typen wie Produktseiten, Nachrichtenseiten, Über-uns-Seiten und Kontaktseiten und legen Sie differenzierte lastmod- und priority-Werte fest
  • Generieren Sie nach Abschluss einer Website-Migration (HTTP-zu-HTTPS-Upgrade, Domainwechsel) die Sitemap neu und übermitteln Sie sie, um Crawler zum schnellen Crawlen neuer Adressen zu führen
  • Ergänzen Sie manuell von Plugins wie Yoast SEO generierte Sitemaps und fügen Sie spezielle Seiten-URLs hinzu, die vom Plugin nicht abgedeckt werden
  • Generieren Sie nach SEO-Diagnose und -Optimierung die Sitemap neu, um sicherzustellen, dass die priority-Einstellungen wichtiger Seiten angemessen sind und das Crawling-Gewicht hochwertiger Seiten erhöht wird
  • Validieren Sie vor der Deklaration der Sitemap-Position in robots.txt mit diesem Tool die XML-Formatkorrektheit, um Crawler-Parsing-Fehler zu vermeiden

Anleitung

  1. Fügen Sie im URL-Eingabebereich die Liste der zu indexierenden Seitenadressen ein, eine vollständige URL pro Zeile (muss http:// oder https://-Protokoll-Header enthalten)
  2. Wählen Sie im changefreq-Dropdown-Menü die Seitenaktualisierungsfrequenz: Startseite wählen Sie daily oder hourly, Artikelseiten weekly, statische Seiten yearly oder monthly
  3. Ziehen Sie den priority-Schieberegler oder geben Sie einen Wert zwischen 0.0 und 1.0 ein, um die Priorität festzulegen: Kern-Startseite auf 1.0 setzen, wichtige Kategorieseiten 0.8, normale Artikelseiten 0.5, Archivseiten 0.3
  4. Klicken Sie auf den lastmod-Datumswähler, wählen Sie das Datum der letzten Inhaltsänderung der Website oder lassen Sie das lastmod-Feld leer
  5. Überprüfen Sie im rechten Echtzeit-Vorschaubereich, ob die generierte XML-Struktur korrekt ist; ungültige URLs werden rot markiert zur Korrektur
  6. Klicken Sie nach Bestätigung auf die Schaltfläche „sitemap.xml herunterladen“, um die Datei zu speichern, oder auf die Schaltfläche „Kopieren“, um den XML-Inhalt in die Zwischenablage zu kopieren
  7. Laden Sie sitemap.xml in das Website-Stammverzeichnis hoch, fügen Sie in robots.txt eine Sitemap-Deklaration hinzu oder übermitteln Sie sie direkt an Google Search Console/Bing Webmaster

Funktionen

  • Batch-URL-Eingabe-Unterstützung: Eine URL pro Zeile, automatische Filterung leerer Zeilen und doppelter Links zur schnellen Verarbeitung großer Mengen von Seitenadressen
  • Automatisches XML-Entitäts-Escaping: Sonderzeichen wie &, <, >, ", ' in URLs werden automatisch zu &amp;, &lt;, &gt;, &quot;, &apos; escaped, um XML-Parsing-Fehler vollständig zu vermeiden
  • 7 changefreq-Aktualisierungsfrequenz-Optionen: always, hourly, daily, weekly, monthly, yearly, never – decken alle Seitentypszenarien ab
  • Präzise priority-Prioritätseinstellung: Unterstützt beliebige Werte im Bereich von 0.0 bis 1.0 mit einer Dezimalstelle zur Unterscheidung der Seitenwichtigkeit
  • lastmod-Datumswähler für die letzte Änderungszeit: Visueller Kalenderwähler, automatisch formatiert im W3C-Datetime-Standardformat (YYYY-MM-DD)
  • Echtzeiterkennung ungültiger URLs: Automatische Erkennung formatfehlerhafter URLs (fehlendes Protokoll, ungültige Zeichen usw.) mit Markierung der problematischen Zeilennummern zur Korrektur
  • Echtzeit-Vorschau-Generierung: XML-Inhalt wird sofort aktualisiert, wenn Sie die URL-Liste oder Konfigurationsparameter ändern – kein manuelles Klicken auf eine Generierungsschaltfläche erforderlich
  • Ein-Klick-Download von sitemap.xml: Generierte Ergebnisse werden direkt als Standard-XML-Datei heruntergeladen und können sofort auf den Website-Server hochgeladen werden
  • URL-Limit-Warnung: Automatische Hinweismeldung bei Erreichen von 50.000 URLs, dass eine Sitemap-Index-Aufteilungslösung verwendet werden muss
  • In Zwischenablage kopieren: Ein-Klick-Kopie des vollständigen XML-Inhalts in die Zwischenablage zum direkten Einfügen in Serverdateien oder Online-Übermittlung
  • Byte-Größenstatistik: Echtzeitanzeige der Byte-Größe der generierten Sitemap-XML-Datei zur Bewertung, ob die Dateigröße den Suchmaschinenbeschränkungen entspricht
  • Standard-urlset-Wurzelelement-Ausgabe: Folgt streng der http://www.sitemaps.org/schemas/sitemap/0.9-Protokollspezifikation mit korrekter xmlns-Namespace-Deklaration
  • UTF-8-Kodierungsdeklaration: Automatische Hinzufügung der XML-Kodierungsdeklaration zur korrekten Verarbeitung mehrsprachiger URLs ohne Zeichenfehler

Häufig gestellte Fragen

Muss eine Sitemap unbedingt übermittelt werden? Wird eine Website ohne Übermittlung nicht indexiert?

Eine Website kann auch ohne Übermittlung einer Sitemap indexiert werden – Suchmaschinen können Ihre Seiten durch Backlinks von anderen Websites und Tracking interner Links entdecken. Die Übermittlung einer Sitemap kann jedoch die Entdeckungsgeschwindigkeit erheblich beschleunigen, insbesondere bei neuen Websites, großen Websites und Websites mit unvollständigen internen Links. Google empfiehlt offiziell allen Websites, eine Sitemap zu übermitteln. Dies ist eine grundlegende SEO-Arbeit mit sehr geringen Kosten und hohem Nutzen.

Müssen URLs in der Sitemap absolute Pfade sein? Können relative Pfade geschrieben werden?

Es müssen vollständig absolute URLs sein, die den Protokoll-Header (http:// oder https://) und den vollständigen Domainnamen enthalten. Es können keine relativen Pfade (wie /page1.html) oder schreibweisen ohne Protokoll verwendet werden. Suchmaschinen benötigen vollständige URLs, um Sitemaps korrekt zu parsen und zu crawlen. Relative Pfade führen zu Parsing-Fehlern.

Sind die changefreq- und priority-Einstellungen wirklich nützlich? Befolgen Suchmaschinen sie?

Beide Felder sind „Hinweise“, keine „Anweisungen“. Suchmaschinen befolgen sie nicht unbedingt zu 100%, aber genaue Einstellungen haben dennoch Referenzwert. Im Vergleich dazu ist lastmod (Zeit der letzten Änderung) das am meisten von Suchmaschinen beachtete der drei Felder, da es Crawlern direkt mitteilen kann, ob eine Seite neue Inhalte hat. Setzen Sie nicht alle Seiten unehrlich auf die höchste Priorität oder always, da dies dazu führt, dass Suchmaschinen diesen Metadaten nicht mehr vertrauen.

Muss die Sitemap-Datei im Website-Stammverzeichnis platziert werden?

Nicht unbedingt. Die Sitemap kann unter einem beliebigen Pfad auf der Website platziert werden, solange die URL normal zugänglich ist. robots.txt muss jedoch im Stammverzeichnis platziert werden. Wenn Sie mit dem Sitemap-Index mehrere Unter-Sitemaps aufgeteilt haben, gibt es keine Einschränkungen für die Pfade der Unter-Sitemaps. Allerdings ist die Platzierung im Stammverzeichnis aus Gewohnheit am bequemsten zu verwalten und für Crawler am einfachsten zu entdecken.

Die Website hat weniger als 50.000 URLs, aber die Dateigröße überschreitet 50 MB – was tun?

Die Sitemap muss aufgeteilt werden. 50.000 URLs und 50 MB sind zwei nebeneinander bestehende Beschränkungen. Wenn eine der Grenzwertüberschreitungsbedingungen erfüllt ist, muss aufgeteilt werden. Sie können nach Inhaltstyp aufteilen oder die Sitemap vereinfachen (z. B. unnötige Leerzeichen und Einrückungen entfernen, gzip-Komprimierung verwenden). Wenn sie jedoch nach der Komprimierung immer noch 50 MB überschreitet, muss sie aufgeteilt werden.

Können noindex-Seiten oder durch robots.txt verbotene URLs in der Sitemap enthalten sein?

Nicht empfohlen. Die Sitemap sollte nur Seiten enthalten, die Sie von Suchmaschinen crawlen und indexieren lassen möchten. noindex-Seiten, durch Disallow verbotene Seiten, Seiten, für die eine Anmeldung erforderlich ist, und 404-Fehlerseiten sollten nicht in der Sitemap erscheinen. Dies verringert das Vertrauen von Suchmaschinen in die Sitemap und verschwendet Crawl-Budget.

Muss die Sitemap nach Inhaltsaktualisierungen erneut übermittelt werden? Wie oft sollte die Sitemap aktualisiert werden?

Solange die Sitemap-Datei-URL unverändert bleibt, crawlen Suchmaschinen regelmäßig neu. Es ist nicht erforderlich, sie jedes Mal bei Inhaltsaktualisierungen manuell erneut zu übermitteln. Die Aktualisierungsfrequenz hängt von der Inhaltsaktualisierungsfrequenz Ihrer Website ab: Nachrichten-Websites können die Sitemap täglich oder sogar stündlich aktualisieren (automatisch generiert), Unternehmenswebsites einmal wöchentlich oder monatlich. Serverseitige Skripte können so eingestellt werden, dass sie die Sitemap-Datei automatisch aktualisieren.

Welche Sprachen von URLs unterstützt Sitemap? Müssen chinesische URLs kodiert werden?

Sitemap unterstützt URLs in beliebigen Sprachen, aber URLs mit Nicht-ASCII-Zeichen (wie Chinesisch) müssen URL-kodiert sein (auch Prozentkodierung genannt, percent-encoding). Zum Beispiel wird „Chinesische Seite“ zu %E4%B8%AD%E6%96%87%E9%A1%B5%E9%9D%A2 kodiert. Die meisten Browser und Tools verarbeiten dies automatisch, aber Sie müssen sicherstellen, dass die URLs in der generierten Sitemap korrekt kodiert sind.

Können mehrere Sitemaps gleichzeitig übermittelt werden? Zum Beispiel gleichzeitig Artikel-Sitemap und Produkt-Sitemap?

Ja, es gibt zwei Möglichkeiten: ①Verwenden Sie eine Sitemap-Index-Datei zur einheitlichen Verwaltung aller Unter-Sitemaps. Dies ist die empfohlene Methode, Sie müssen nur die Indexdatei-URL übermitteln; ②Übermitteln Sie die URL jeder Unter-Sitemap einzeln auf der Webmaster-Plattform. Diese Methode ist ebenfalls möglich, aber die Verwaltung ist umständlicher. Beide Methoden sind wirksam, Suchmaschinen crawlen beide.

Muss die generierte Sitemap mit gzip komprimiert werden? Welche Vorteile hat die Komprimierung?

Komprimierung ist nicht zwingend erforderlich, wird aber dringend empfohlen. gzip-Komprimierung reduziert die Sitemap-Größe normalerweise um 70-80%, spart Bandbreite und Crawling-Zeit, insbesondere bei großen Websites ist der Effekt offensichtlich. Suchmaschinen unterstützen das komprimierte Format sitemap.xml.gz vollständig und dekomprimieren es automatisch. Solange es nach der Komprimierung 50 MB nicht überschreitet, ist es in Ordnung.

Müssen für HTTP- und HTTPS-Versionen der Website beide Sitemaps übermittelt werden?

Sie sollten nur die bevorzugte Version übermitteln, die Sie indexieren lassen möchten. Wenn die gesamte Website HTTPS verwendet und eine HTTP→HTTPS 301-Weiterleitung durchgeführt wurde, muss nur die HTTPS-Version der Sitemap übermittelt werden. Übermitteln Sie nicht sowohl HTTP- als auch HTTPS-Versionen gleichzeitig, da dies zu Doppelinhalts-Problemen führt. Ebenso muss für www und nicht-www die bevorzugte Domain bestimmt werden und nur die Sitemap der bevorzugten Domain übermittelt werden.

WordPress hat mit Yoast SEO eine Sitemap generiert – wird dieses Tool noch benötigt?

Yoast SEO kann automatisch Sitemaps für die meisten Seiten generieren, aber möglicherweise einige Seiten übersehen – wie manuell erstellte Einzelseiten, nicht konfigurierte benutzerdefinierte Post-Typen, spezielle Landingpages, extern importierte Seiten usw. Sie können dieses Tool verwenden, um diese von Yoast nicht abgedeckten URLs zu ergänzen, eine separate ergänzende Sitemap zu generieren oder zu überprüfen, ob die von Yoast generierte Sitemap vollständig und korrekt ist.

Ist die Reihenfolge der URLs in der Sitemap wichtig? Ist es nützlich, wichtige Seiten vorne zu platzieren?

Im Sitemap-Protokoll hat die URL-Reihenfolge keine offizielle Gewichtung. Suchmaschinen crawlen URLs nicht bevorzugt, nur weil sie vorne stehen. Einige SEO-Praktiker haben jedoch einen leichten Reihenfolge-Präferenzeffekt beobachtet. Es schadet also nicht, wichtige URLs vorne zu platzieren, aber erwarten Sie keine deutliche Wirkung davon. Sie sollten die Priorität weiterhin korrekt über das priority-Feld kennzeichnen.

Müssen paginierte Seiten (wie /list?page=2, /page/3) in die Sitemap aufgenommen werden?

Dies hängt vom Wert des paginierten Inhalts ab. Wenn die Paginierung sich wiederholende Listen wie „Mehr anzeigen“ sind (wie Seite 2, Seite 3 von Artikellisten), wird normalerweise nicht empfohlen, sie in die Sitemap aufzunehmen, da diese Seiten inhaltlich wiederholt und von geringem Wert sind. Der Fokus sollte auf der List-Startseite und einzelnen Artikelseiten liegen. Wenn paginierte Seiten jedoch eindeutige Inhalte haben (wie Kategoriesurfen, Paginierung mit eigenständigem Wert), können sie mit niedrigerer priority aufgenommen werden.

Wie validiere ich, ob eine Sitemap korrekt und gültig ist?

Es gibt mehrere Validierungsmethoden: ①Zeigen Sie nach der Generierung mit diesem Tool zuerst lokal eine Vorschau der XML-Struktur an, überprüfen Sie, ob Tag-Schließung, Namespace und Escape-Zeichen normal sind; ②Verwenden Sie das sitemap-inspector-Tool zur Online-Validierung von Format und URL-Zugänglichkeit, überprüfen Sie die HTTP-Statuscodes aller URLs batchweise; ③Greifen Sie nach dem Hochladen direkt im Browser auf die Sitemap-URL zu, um zu sehen, ob sie normal angezeigt wird, ohne XML-Parsing-Fehler; ④Zeigen Sie nach der Übermittlung an Google Search Console/Bing Webmaster Tools den Statusbericht an, um zu sehen, ob es Fehlermeldungen wie Formatfehler, nicht zugängliche URLs, Grenzwertüberschreitungen gibt – dies ist die maßgeblichste Validierungsmethode; ⑤Sie können auch Online-XML-Validierungstools zur Überprüfung der XML-Syntaxkorrektheit verwenden.

Fehlerbehebung

Die generierte Sitemap-XML zeigt beim Öffnen im Browser Parsing-Fehler an und weist auf ein falsches Format hin

URLs enthalten XML-Sonderzeichen wie &, <, >, die nicht escaped wurden: Beim Einfügen hat das Tool automatisch escaped, aber wenn Sie die Datei manuell bearbeitet haben, wurde das Escaping möglicherweise übersehen XML-Deklaration oder urlset-Namespace ist falsch geschrieben: Überprüfen Sie, ob der xmlns-Wert in der ersten Zeile vollständig mit http://www.sitemaps.org/schemas/sitemap/0.9 übereinstimmt, keine zusätzlichen Schrägstriche Tags sind nicht korrekt geschlossen: Alle Start-Tags wie &lt;url&gt;, &lt;loc&gt; müssen entsprechende schließende Tags &lt;/url&gt;, &lt;/loc&gt; haben, selbstschließende Tags dürfen nicht falsch geschrieben werden Dateikodierung ist nicht UTF-8 ohne BOM: Windows Notepad speichert möglicherweise als UTF-8 mit BOM oder GBK-Kodierung, was Parsing-Fehler verursacht; speichern Sie als UTF-8 ohne BOM URLs enthalten ungültige Zeichen: Chinesische URLs müssen URL-kodiert sein (percent-encoding), nicht kodierte Sonderzeichen führen zu XML-Parsing-Fehlern XML-Versionsdeklaration ist falsch: Die erste Zeile muss &lt;?xml version="1.0" encoding="UTF-8"?&gt; sein, nicht 1.1 oder eine andere Version schreiben Tag-Schachtelungsreihenfolge ist falsch: Unter-Tags müssen vollständig innerhalb von Eltern-Tags enthalten sein, keine Kreuzschachtelung, wie z. B. die falsche Reihenfolge &lt;url&gt;&lt;loc&gt;&lt;/url&gt;&lt;/loc&gt;

Nach der Übermittlung der Sitemap an Google Search Console wird „Sitemap konnte nicht gelesen werden“ oder „Formatfehler“ angezeigt

Sitemap-Datei-URL ist nicht zugänglich: Überprüfen Sie, ob der direkte Zugriff auf die Sitemap-URL im Browser den Statuscode 200 zurückgibt, keine 403/404/500-Fehler Der Server gibt einen falschen Content-Type zurück: Sollte application/xml oder text/xml zurückgeben, die Rückgabe von text/html führt zu Identifizierungsfehlern Die Sitemap enthält URLs, die durch robots.txt verboten sind: GSC meldet einen Fehler, wenn es Disallow-Pfade in der Sitemap erkennt URL-Weiterleitungsproblem: Wenn die Sitemap-URL mit 301/302 zu einer anderen Adresse weiterleitet, führt dies zu Fehlern. Stellen Sie sicher, dass URLs direkt zugänglich sind und nicht weiterleiten HTTP/HTTPS oder www/ohne-www stimmen nicht überein: Die übermittelte Sitemap-Domain stimmt nicht mit der in GSC bestätigten Domain überein (z. B. ist www.example.com bestätigt, aber die Sitemap verwendet example.com) Die Sitemap-Datei ist zu groß, überschreitet die 50-MB-Grenze oder URLs überschreiten 50.000: GSC lehnt die Verarbeitung von Dateien, die die Grenzwerte überschreiten, direkt ab HTML-Entitäten anstelle von XML-Entitäten verwendet: Das geschützte Leerzeichen &amp;nbsp; ist eine HTML-Entität, keine XML-Entität, und kann in XML nicht verwendet werden

Die Sitemap wurde vor langer Zeit übermittelt, aber viele URLs wurden immer noch nicht von Google indexiert

Seitenqualitätsproblem: Indexierung erfolgt nicht automatisch nach Übermittlung. Seiten mit geringer Originalität des Inhalts, doppeltem Inhalt oder Inhalten mit geringem Wert werden von Google möglicherweise nicht indexiert Prüfphase für neue Websites (Sandbox-Effekt): Neue Websites benötigen nach der Sitemap-Übermittlung möglicherweise eine Beobachtungsphase von einigen Wochen bis Monaten, bevor sie massenhaft indexiert werden Seite ist noindex: Die von der URL zurückgegebene Seite enthält ein noindex-meta-Tag oder einen X-Robots-Tag: noindex-Antwortheader, Google schließt sie aktiv aus Unzureichendes Crawl-Budget der Website: Geringe Website-Gewichtung, langsame Server-Antwort, schlechte interne Linkstruktur führen dazu, dass Google-Crawler eine niedrige Crawling-Frequenz zuweisen und mehr Zeit benötigen Die Sitemap enthält viele URLs geringer Qualität: Wenn viele URLs in der Sitemap 404-Fehler, 5xx-Fehler, doppelte Inhalte oder Seiten mit geringem Wert sind, verringert Google das Vertrauen in die gesamte Sitemap Domain wurde bestraft: Die Website hat Probleme, die gegen die Google-Qualitätsrichtlinien verstoßen (wie Spamming, Junk-Inhalt, Malware), was die Indexierung behindert Seiten sind isolierte Seiten: Obwohl die Seiten in der Sitemap stehen, gibt es keine Eingänge über interne Links der Website. Crawler halten sie möglicherweise für unwichtig und indexieren sie nicht

In der Sitemap werden gefundene URLs angezeigt, aber die tatsächliche Indexanzahl ist sehr gering

Dies ist normal: „Gefunden“ bedeutet nur, dass Google die Sitemap besucht und die URLs gesehen hat, nicht dass alle indexiert werden. Die Indexierungsrate hängt von der Seitenqualität ab Doppelinhalts-Problem: Mehrere URLs mit sehr ähnlichem Inhalt (wie dieselbe Seite mit unterschiedlichen Parametern, Druckversionen, Paginierung). Google wählt eine kanonische Version zur Indexierung aus Kanonisierungs-Tag (canonical) verweist auf andere Seiten: Die Seite hat &lt;link rel="canonical" href="andere URL"&gt; gesetzt. Google indexiert die Adresse, auf die canonical verweist Seiteninhalt ist zu dünn: Zu wenige Wörter im Inhalt, kein substanzieller Wert, gesammelter Inhalt – Google hält sie für nicht indexierungswert Seitenladegeschwindigkeit ist zu langsam: Server-Antwort-Timeout, zu langsames Laden der Seite. Nach mehreren fehlgeschlagenen Crawling-Versuchen verringern Crawler die Crawling-Priorität HTTPS-Zertifikatsproblem: Ungültiges SSL-Zertifikat, Mixed-Content-Fehler, gleichzeitiges Vorhandensein von HTTP/HTTPS-Versionen führen zu Kanonisierungsproblemen Mobile Anpassungsproblem: Schlechte mobile Freundlichkeit, Fehler bei der mobilen Anpassung beeinträchtigen die Indexierung in einer Mobile-First-Indexierungsumgebung

Bing kann die Sitemap normal crawlen, aber Google crawlt überhaupt nicht

Bestätigungsproblem in Google Search Console: Bestätigen Sie, dass die Domain-Eigentumsbestätigung gültig ist und die bestätigte Domain (www/ohne-www, http/https) mit der tatsächlich aufgerufenen Version übereinstimmt Server-Firewall oder CDN blockiert Googlebot: Überprüfen Sie die Server-Zugriffsprotokolle, ob Anfragen von Googlebot (user-agent enthält Googlebot) blockiert werden oder 403 zurückgeben DNS-Auflösungsproblem: Googles DNS-Auflösung führt zu einer anderen IP-Adresse als Bing. Stellen Sie sicher, dass alle Regionen normal zu Ihrem Server auflösen können robots.txt hat spezielle Beschränkungen für Googlebot: Überprüfen Sie, ob unter User-agent: Googlebot spezielle Disallow-Regeln vorhanden sind Die Website hatte in der Vergangenheit Spamming-Vorgeschichte und wurde von Google herabgestuft: Domains, die manuell bestraft wurden, müssen zuerst eine erneute Überprüfung beantragen Die Sitemap-URL enthält Inhalte, die Google als unsicher einstuft: wie als Malware oder Phishing markierte Domains CDN-WAF-Regeln blockieren fälschlicherweise: Einige Sicherheitsregeln können das Crawler-Verhalten von Googlebot falsch interpretieren, CDN-Sicherheitsprotokolle müssen überprüft werden

Die generierte Sitemap funktioniert lokal einwandfrei, nach dem Hochladen auf den Server gibt der Zugriff jedoch einen 404-Fehler zurück

Dateipfad ist falsch: sitemap.xml wurde nicht in das richtige Verzeichnis hochgeladen. Bestätigen Sie, dass sie an die Position hochgeladen wurde, die der URL entspricht, die Sie in robots.txt und an Suchmaschinen übermittelt haben Dateinamen-Groß-/Kleinschreibungsproblem: Linux/Unix-Server unterscheiden zwischen Groß- und Kleinschreibung. Sitemap.xml und sitemap.xml sind unterschiedliche Dateien. Stellen Sie sicher, dass der Dateiname vollständig kleingeschrieben ist Nginx/Apache-Konfiguration verbietet den Zugriff auf XML-Dateien: Überprüfen Sie die Serverkonfiguration, ob location-Regeln den Zugriff auf Dateien mit der Endung .xml verweigern oder falsche try_files-Regeln zurückgeben Dateiberechtigungsproblem: Dateiberechtigungen auf dem Server sind falsch eingestellt (z. B. 600-Berechtigung), der Webserver-Benutzer hat keine Leseberechtigung. Normalerweise ist 644-Berechtigung erforderlich, Verzeichnisse benötigen 755-Berechtigung CDN hat alte 404-Antwort gecacht: Bei neu hochgeladenen Dateien cached das CDN möglicherweise noch die vorherige 404-Antwort. CDN-Cache muss aktualisiert werden oder warten Sie auf die automatische CDN-Quellenaktualisierung Permalink-Regeln von CMS wie WordPress stehen im Konflikt: CMS-Umschreibungsregeln haben sitemap.xml abgefangen. Es müssen Ausschlussregeln konfiguriert werden, damit der Server direkt auf statische Dateien zugreift Server hat Hotlink-Schutz oder Zugriffskontrolle konfiguriert: Referrer-Prüfungen, IP-Whitelists und andere Regeln in .htaccess oder Nginx-Konfiguration können den Crawler-Zugriff blockieren

Glossar

Sitemap
Eine XML-Protokollstandarddatei, die Suchmaschinen über alle zum Crawlen verfügbaren Seiten einer Website informiert. Enthält eine vollständige URL-Liste und Metadaten für jede URL, hilft Crawlern wie Googlebot und Bingbot, Website-Inhalte intelligenter und effizienter zu entdecken, zu verstehen und zu crawlen. Der einheitliche offene Protokollstandard wird von der Organisation sitemaps.org gewartet (aktuelle Version 0.9).
urlset
Das Wurzelelement einer Standard-Sitemap-XML-Datei, muss eine korrekte xmlns-Namespace-Deklaration enthalten, alle &lt;url&gt;-Unterelemente darin verschachteln. Es ist die Kernkennung für die Gültigkeit der Sitemap. Eine Sitemap ohne korrekte urlset-Struktur wird von Suchmaschinen direkt zum Parsen abgelehnt.
Sitemap Index
Eine Sitemap-Indexdatei, die verwendet werden muss, wenn die Anzahl der Website-URLs 50.000 überschreitet oder die Größe einer einzelnen Sitemap-Datei 50 MB überschreitet. Das Wurzelelement ist &lt;sitemapindex&gt;, wird zum einheitlichen Auflisten und Verwalten der Adressen mehrerer Unter-Sitemap-Dateien verwendet und ist die Standardlösung für die Sitemap-Aufteilung großer Websites.
changefreq
Optionales Metadatenelement in der Sitemap zur Angabe der ungefähren Aktualisierungsfrequenz von Seiteninhalten. Es gibt sieben gültige Werte: always, hourly, daily, weekly, monthly, yearly, never. Dient Suchmaschinen-Crawlern als Referenz zur Planung der Besuchsfrequenz. Korrekte Einstellung kann die Zuweisung des Crawl-Budgets optimieren.
priority
Optionales Metadatenelement in der Sitemap zur Angabe der Wichtigkeitspriorität dieser URL relativ zu anderen Seiten innerhalb der Website. Der Wertebereich liegt zwischen 0.0 und 1.0, der Standardwert ist 0.5. priority beeinflusst nur die relative Crawling-Priorität zwischen seiteninternen Seiten, nicht das Ranking in Suchergebnissen.
lastmod
Optionales Metadatenelement in der Sitemap, das Datum und Uhrzeit der letzten inhaltlichen Änderung einer Seite aufzeichnet. Das Format muss der W3C-Datetime-Spezifikation folgen. Es ist das am meisten von Suchmaschinen beachtete der drei optionalen Metadatenfelder, da es direkt angibt, ob eine Seite neue Inhalte zum erneuten Crawlen hat.
loc
Erforderliches Unterelement unter dem &lt;url&gt;-Element zur Angabe der vollständigen absoluten URL-Adresse einer Seite. Muss mit http:// oder https://-Protokoll beginnen, einen vollständigen Domainnamen enthalten, die Gesamtlänge der URL darf 2.048 Zeichen nicht überschreiten, relative Pfade sind nicht zulässig.
XML-Namespace (xmlns)
XML-Namespace-Attribut, das im urlset-Wurzelelement deklariert werden muss. Der Attributwert muss exakt http://www.sitemaps.org/schemas/sitemap/0.9 entsprechen, dient zur Kennzeichnung der von der Sitemap verwendeten Protokollversion. Fehlender oder falscher Namespace führt zu Sitemap-Parsing-Fehlern.
W3C Datetime
Von W3C (World Wide Web Consortium) festgelegtes Datums- und Uhrzeitdarstellungsformat. Das lastmod-Feld in Sitemaps muss diesem Format folgen. Häufig wird das vereinfachte Datumsformat YYYY-MM-DD verwendet (beste Kompatibilität), es unterstützt auch das vollständige Datums-Zeit-Format mit Stunden, Minuten, Sekunden und Zeitzoneninformationen.
XML-Entitäts-Escaping
In der XML-Syntax müssen Sonderzeichen zu entsprechenden Entitätsreferenzen escaped werden, um korrekt geparst zu werden: & wird zu &amp;, < wird zu &lt;, > wird zu &gt;, " wird zu &quot;, ' wird zu &apos;. URLs, die diese Zeichen enthalten, müssen escaped werden, da dies sonst zu XML-Parsing-Fehlern führt.
Google Search Console (GSC)
Von Google offiziell bereitgestellte Webmaster-Plattform zum Übermitteln von Sitemaps, Anzeigen des Website-Indexstatus, Analyse von Suchverkehrsdaten, Crawling-Fehlerberichten, Sicherheitsproblembenachrichtigungen, Benachrichtigungen über manuelle Maßnahmenstrafen usw. Ein unverzichtbares Tool für die Google-Suchmaschinenoptimierung (SEO).
Bing Webmaster Tools
Offizielle Webmaster-Plattform der Microsoft-Bing-Suchmaschine mit ähnlichen Funktionen wie Google Search Console. Unterstützt Sitemap-Übermittlung, Indexabdeckungsstatistiken, SEO-Diagnoseanalyse, Keyword-Recherche, Backlink-Abfragen usw. Deckt den Suchverkehr der beiden Suchmaschinen Bing und Yahoo ab.
robots.txt
Reine Textdatei im Website-Stammverzeichnis, die Suchmaschinen-Crawlern über Direktiven wie User-agent, Disallow, Allow mitteilt, welche Pfade gecrawlt werden dürfen und welche nicht. Gleichzeitig kann die Position der Sitemap-Datei in der Datei deklariert werden, damit Crawler sie automatisch entdecken.
Crawler (Spider/Bot)
Von Suchmaschinen entwickelte Programme zum automatischen Crawlen von Webinhalten, wie Googlebot (Google-Crawler), Bingbot (Bing-Crawler), Baiduspider (Baidu-Crawler). Entdecken neue Seiten durch Verfolgen von Seitenlinks und Lesen von Sitemap-Dateien, laden Seiteninhalte herunter und speichern sie im Suchmaschinenindex.
Crawl-Budget
Gesamtmenge an Crawling-Ressourcen, die Suchmaschinen einer Website in einem bestimmten Zeitraum zuweisen. Wird von verschiedenen Faktoren wie Domain-Gewichtung, Server-Antwortgeschwindigkeit, Seiteninhaltsqualität, historischen Crawling-Ergebnissen gemeinsam bestimmt. Die korrekte Konfiguration von Sitemap kann helfen, die Nutzungseffizienz des Crawl-Budgets zu optimieren.
UTF-8-Kodierung
Zeichenkodierung, die für Sitemap-XML-Dateien zwingend erforderlich ist. UTF-8 unterstützt alle Unicode-Zeichen, einschließlich Chinesisch. Wird in der XML-Deklaration über das Attribut encoding="UTF-8" angegeben. Die Verwendung anderer Kodierungen (wie GBK, GB2312) kann zu Zeichenfehlern bei chinesischen URLs und Parsing-Fehlern führen.
gzip-Komprimierung
Das Sitemap-Protokoll unterstützt die komprimierte Übertragung mit dem gzip-Algorithmus (Dateiendung .xml.gz), wodurch die Größe von Sitemap-Dateien um 70–80% reduziert werden kann, was Server-Bandbreite und Crawling-Zeit erheblich einspart. Führende Suchmaschinen können gzip-komprimierte Sitemap-Dateien automatisch dekomprimieren und verarbeiten. Auch komprimiert muss die 50-MB-Größenbeschränkung eingehalten werden.
Yoast SEO
Weit verbreitetes SEO-Plugin auf CMS-Plattformen wie WordPress und Shopify, das automatisch Sitemaps, meta-Tags, Breadcrumb-Navigation, XML-Sitemaps, RSS-Optimierung, Social-Media-Metadaten und andere SEO-bezogene Funktionen generiert. Es ist eine häufig verwendete SEO-Lösung für inhaltsorientierte Websites.
Indexabdeckung (Index Coverage)
Einer der Kernberichte in Google Search Console, der detailliert die genaue Anzahl und Gründe für indexierte, ausgeschlossene, fehlerhafte und warnende Seiten auf einer Website anzeigt. Kann verwendet werden, um die Wirkung der Sitemap-Übermittlung zu validieren und Probleme bei der Seitenindexierung zu diagnostizieren.
URL-Kodierung (Percent-Encoding)
Auch als Prozentkodierung bekannt, eine Kodierungsmethode zur Darstellung von Nicht-ASCII-Zeichen (wie Chinesisch, Sonderzeichen) in URLs. Chinesische Zeichen werden in die Form %XX%XX%XX kodiert (z. B. wird „Chinesisch“ zu %E4%B8%AD%E6%96%87 kodiert). Chinesische URLs in Sitemaps müssen korrekt kodiert sein, um geparst zu werden.

changefreq-Aktualisierungsfrequenz-Szenarien-Vergleichstabelle

changefreq-WertAktualisierungsfrequenzTypische geeignete SeitentypenHinweise
alwaysKann sich bei jedem Besuch ändernEchtzeitdatenseiten, Sucheinstellungen, dynamische AggregationsseitenBedeutet nicht, dass Crawler jedes Mal kommen, nur extrem hohe Änderungsfrequenz; nicht missbrauchen, normale Seiten nicht auf always setzen
hourlyStündlich aktualisiertNachrichtenstartseiten, Social-Media-Dynamik, Echtzeit-KursseitenGeeignet für Seiten mit stündlich neuen Inhalten, nicht für Seiten mit geringer Aktualisierungsfrequenz
dailyTäglich aktualisiertWebsite-Startseiten, Blog-Listenseiten, Nachrichtenseiten, ProduktkategorieseitenEiner der am häufigsten verwendeten Werte, geeignet für die Startseite und Kategorieseiten der meisten Websites
weeklyWöchentlich aktualisiertNormale Artikeldetailseiten, Produktdetailseiten, Blog-HauptteiltseitenDies ist für die Hauptteiltseiten der meisten inhaltsorientierten Websites angemessen
monthlyMonatlich aktualisiertKategorieseiten, Archivseiten, FAQ-Seiten, AnleitungsseitenHilfsseiten mit seltener Inhaltsaktualisierung aber gelegentlichen Anpassungen
yearlyJährlich aktualisiertUnternehmensvorstellungsseiten, Kontaktseiten, Nutzungsbedingungen, DatenschutzrichtlinienStatische Informationsseiten, die sich fast nie ändern
neverNie aktualisiertHistorische Artikelarchive, abgelaufene Veranstaltungsseiten, archivierte alte InhalteAuf never setzen für Seiten, die definitiv nicht mehr geändert werden; bei Aktualisierungen rechtzeitig zurücksetzen

Referenztabelle für priority-Prioritätseinstellungen

priority-WertPrioritätsebeneGeeignete SeitentypenEmpfohlener Anteil an der Gesamtseitenanzahl
1.0HöchsteWebsite-Startseite, Kern-Landingpages, wichtigste Kanal-EinstiegsseitenNur 1-3 Seiten auf der gesamten Website
0.8-0.9Sehr hochHauptkategorieseiten, beliebte Kategorieseiten, Kernproduktseiten, wichtige ThemenEtwa 5-10% der Gesamtseiten
0.6-0.7HochNebenkategorieseiten, Unterkategorieseiten, beliebte Artikel, wichtige ProduktdetailsEtwa 10-20% der Gesamtseiten
0.4-0.5NormalNormale Artikeldetailseiten, allgemeine Produktseiten, reguläre InhaltsseitenEtwa 40-60% der Gesamtseiten (Standardwert)
0.2-0.3NiedrigTag-Seiten, Archivpaginierung, alte Artikelarchive, HilfsseitenEtwa 15-25% der Gesamtseiten
0.0-0.1NiedrigsteSeiten mit geringem Wert, doppelte Inhaltsseiten, Seiten, die nicht bevorzugt gecrawlt werden sollenInnerhalb von etwa 5% der Gesamtseiten, 0 bedeutet nicht, dass die Indexierung verboten ist

Tabelle der Sitemap-Protokollspezifikationsbeschränkungen

BeschränkungselementObergrenzeBeschreibungLösung bei Grenzwertüberschreitung
URL-Anzahl pro einzelner Sitemap50.000Fest vorgeschrieben durch das sitemap.org 0.9-ProtokollVerwenden Sie Sitemap-Index zur Aufteilung in mehrere Unter-Sitemaps
Unkomprimierte Dateigröße pro einzelner Sitemap50MB (52.428.800 Bytes)Originaldateigröße einschließlich aller Tags und Leerzeichengzip-Komprimierung verwenden, Sitemap aufteilen, Kommentare reduzieren
Anzahl der Unter-Sitemaps im Sitemap-Index50.000URL-Eintragsbeschränkung der Indexdatei selbstUnterstützt theoretisch 2,5 Milliarden URLs, für die meisten Websites nicht erforderlich
Länge einer einzelnen URL2.048 ZeichenEinschließlich Protokoll, Domainname, Pfad, alle AbfrageparameterZu lange URLs erfordern Parametervereinfachung oder URL-Rewriting
Von Sitemap unterstützte KodierungsformateUTF-8Protokoll schreibt dies vor, andere Kodierungen können zu Parsing-Fehlern führenStellen Sie beim Speichern der Datei sicher, dass UTF-8-Kodierung verwendet wird
Von Sitemap unterstützte Protokollehttp:// oder https://URL muss vollständigen Protokoll-Header enthaltenAndere Protokolle wie ftp:// werden nicht unterstützt
Crawler-Reaktionszeit nach ÜbermittlungEinige Stunden bis einige TageAbhängig von Website-Gewichtung und Sitemap-KomplexitätKeine wiederholte Übermittlung erforderlich, geduldig auf die Verarbeitung warten
Dateigröße nach gzip-Komprimierung50MBKomprimierte Datei darf ebenfalls die 50-MB-Grenze nicht überschreitenBei Überschreitung nach Komprimierung muss die Sitemap trotzdem aufgeteilt werden