Sitemap Generator

sitemap.xml Generator

Voer een URL-lijst in, stel changefreq, priority en lastmod globaal in, genereer sitemap.org-conforme XML-sitemaps in één klik.

Invoer & parameters
XML-uitvoer
3 geldige URL's, 483 bytes

Genereer online Sitemap XML-websitekaartbestanden die voldoen aan de open sitemap.org 0.9-protocolstandaard. Ondersteunt volledige configuratie van 7 changefreq updatefrequenties, priority 0.0-1.0 relatieve prioriteitsniveaus en lastmod datumkiezer. Bevat automatische XML-entiteit escaping, realtime detectie van ongeldige URL's, live gestructureerd XML-voorbeeld en eenklik download- en kopieerfuncties, waardoor grote zoekmachines waaronder Google en Bing snel alle belangrijke pagina's op uw website kunnen ontdekken en efficiënt indexeren.

Gerelateerde aanbevelingen

Toepassingsgevallen

  • Genereer batchgewijs Sitemaps voor kernpagina's na de lancering van een nieuwe website en dien deze in bij Google Search Console en Bing Webmaster Tools om zoekmachineontdekking en indexering te versnellen
  • Genereer sitemaps opnieuw na herontwerpen van websitesecties of wijzigingen in de URL-structuur om zoekmachine-indexen bij te werken en te voorkomen dat verbroken links de SEO-prestaties beïnvloeden
  • Importeer batchgewijs productlijst-URL's voor e-commercewebsites, waarbij verschillende changefreq- en priority-waarden worden ingesteld op basis van productcategorieën en plaatsingsdatums
  • Genereer meerdere Sitemaps gesplitst per kanaal voor grote portals of nieuwssites die meer dan 50.000 URL's bevatten en maak een Sitemap Index-bestand
  • Configureer geschikte updatefrequenties en prioriteitsparameters voor artikelpagina's, tagpagina's, categoripagina's en archiefpagina's op blogwebsites
  • Organiseer verschillende URL-types voor bedrijfswebsites, waaronder productpagina's, nieuwspagina's, over-pagina's en contactpagina's, met gedifferentieerde lastmod- en priority-waarden
  • Genereer en dien Sitemaps opnieuw na websitemigratie (HTTP naar HTTPS-upgrade, domeinnaamwijziging) om crawlers te begeleiden bij het snel ophalen van nieuwe adressen
  • Vul Sitemaps die zijn gegenereerd door plug-ins zoals Yoast SEO handmatig aan, door speciale pagina-URL's toe te voegen die niet door de plug-in worden gedekt
  • Genereer Sitemaps opnieuw na SEO-diagnose en -optimalisatie om ervoor te zorgen dat belangrijke pagina's redelijke priority-instellingen hebben, waardoor de crawlgewicht voor hoogwaardige pagina's wordt verhoogd
  • Valideer de XML-formaatcorrectheid met deze tool voordat u de Sitemap-locatie in robots.txt declareert om crawler-parseerfouten te voorkomen

Hoe te gebruiken

  1. Plak de lijst met pagina-adressen die moeten worden geïndexeerd in het URL-invoergebied, één volledige URL per regel (moet het http:// of https:// protocolvoorvoegsel bevatten)
  2. Selecteer de pagina-updatefrequentie in het changefreq dropdown-menu: kies daily of hourly voor de startpagina, weekly voor artikelpagina's, yearly of monthly voor statische pagina's
  3. Sleep de priority-schuifregelaar of voer een waarde tussen 0.0-1.0 in om de prioriteit in te stellen: stel de kernstartpagina in op 1.0, belangrijke sectiepagina's op 0.8, gewone artikelpagina's op 0.5, archiefpagina's op 0.3
  4. Klik op de lastmod datumkiezer om de laatste wijzigingsdatum van de website-inhoud te selecteren, of laat het leeg om het lastmod-veld niet op te nemen
  5. Controleer het realtime voorbeeldgebied aan de rechterkant om te verifiëren dat de gegenereerde XML-structuur correct is; ongeldige URL's worden rood gemarkeerd voor correctie
  6. Klik na bevestiging van correctheid op de knop "Download sitemap.xml" om het bestand op te slaan, of klik op de knop "Kopiëren" om de XML-inhoud naar het klembord te kopiëren
  7. Upload sitemap.xml naar de hoofdmap van de website, voeg een Sitemap-verklaring toe in robots.txt, of dien direct in bij Google Search Console/Bing Webmaster

Functies

  • Batchgewijze URL-invoerondersteuning: één URL per regel, met automatische filtering van lege regels en dubbele links voor snelle verwerking van grote batches pagina-adressen
  • Automatische XML-entiteit escaping: Speciale tekens in URL's, waaronder &, <, >, ", en ', worden automatisch ge-escaped naar &amp;, &lt;, &gt;, &quot;, en &apos;, waardoor XML-parseerfouten volledig worden geëlimineerd
  • 7 changefreq updatefrequentie-opties: always, hourly, daily, weekly, monthly, yearly, never — voor alle paginatypescenario's
  • Gedetailleerde priority-instellingen: ondersteunt elke waarde tussen 0.0 en 1.0 met één decimaal nauwkeurigheid, waardoor onderscheid kan worden gemaakt tussen paginabelangrijkheidsniveaus
  • lastmod laatste wijzigingsdatumkiezer: visuele kalenderkiezer die automatisch formatteert naar het W3C Datetime standaardformaat (YYYY-MM-DD)
  • Realtime detectie van ongeldige URL's: identificeert automatisch onjuist opgemaakte URL's (ontbrekend protocol, ongeldige tekens, enz.) en markeert probleemregelnummers voor eenvoudige correctie
  • Realtime voorbeeldgeneratie: XML-inhoud wordt onmiddellijk bijgewerkt wanneer URL-lijsten of configuratieparameters worden gewijzigd — geen handmatige klik op de genereerknop nodig
  • Eenklik download van sitemap.xml: gegenereerde resultaten worden direct gedownload als standaard XML-bestand, klaar voor onmiddellijke upload naar een webserver na opslaan
  • URL-limietwaarschuwing: geeft automatisch een melding voor Sitemap Index splitsing wanneer het aantal ingevoerde URL's 50.000 items bereikt
  • Kopiëren naar klembord: eenklik kopiëren van volledige XML-inhoud naar het klembord voor eenvoudig plakken in serverbestanden of online indiening
  • Bytegrootte-statistieken: toont realtime het aantal bytes van het gegenereerde Sitemap XML-bestand om te beoordelen of de bestandsgrootte voldoet aan de zoekmachinelimieten
  • Standaard urlset root-elementuitvoer: voldoet strikt aan de http://www.sitemaps.org/schemas/sitemap/0.9 protocolspecificatie met correcte xmlns-naamruimtedeclaratie
  • UTF-8-coderingsdeclaratie: voegt automatisch een XML-coderingsdeclaratie toe om ervoor te zorgen dat meertalige URL's correct worden geparseerd zonder tekencorruptie

Veelgestelde vragen

Is Sitemap-indiening verplicht? Wordt mijn site niet geïndexeerd zonder indiening?

Uw site kan ook zonder Sitemap-indiening worden geïndexeerd — zoekmachines kunnen uw pagina's ontdekken via externe links van andere sites en het volgen van interne links. Het indienen van een Sitemap kan de ontdekkingssnelheid echter aanzienlijk versnellen, vooral voor nieuwe sites, grote sites en sites met onvolmaakte interne links. Google raadt officieel aan dat alle websites Sitemaps indienen; het is basis SEO-werk met zeer lage kosten en hoge baten.

Moeten URL's in Sitemaps absolute paden zijn? Kunnen relatieve paden worden gebruikt?

Het moeten volledige absolute URL's zijn, met protocolvoorvoegsel (http:// of https://) en volledige domeinnaam; er kunnen geen relatieve paden (zoals /page1.html) of notaties zonder protocol worden gebruikt. Zoekmachines hebben de volledige URL nodig bij het parseren van Sitemaps om correct te crawlen; relatieve paden veroorzaken parseerfouten.

Zijn changefreq- en priority-instellingen echt nuttig? Volgen zoekmachines ze?

Beide velden zijn "aanwijzingen", geen "richtlijnen"; zoekmachines zullen ze niet noodzakelijk voor 100% volgen, maar nauwkeurige instelling heeft nog steeds referentiewaarde. Ter vergelijking: lastmod (laatste wijzigingstijd) is het belangrijkste van de drie velden voor zoekmachines, omdat het crawlers direct kan vertellen of een pagina nieuwe inhoud heeft. Vervals niet door alle pagina's op de hoogste prioriteit of always in te stellen; hierdoor zullen zoekmachines deze metadata niet meer vertrouwen.

Moet het Sitemap-bestand in de hoofdmap van de website worden geplaatst?

Niet noodzakelijk; Sitemap kan op elk pad in de website worden geplaatst, zolang de URL normaal toegankelijk is. robots.txt moet echter in de hoofdmap worden geplaatst. Als u Sitemap Index gebruikt om meerdere Sitemaps te splitsen, hebben paden van sub-Sitemaps geen beperkingen. Het is echter gebruikelijk om het in de hoofdmap te plaatsen, wat het handigst is voor beheer en crawlers het gemakkelijkst maakt om het te ontdekken.

Wat te doen als het aantal URL's van de website minder is dan 50.000, maar de bestandsgrootte groter is dan 50MB?

Sitemap splitsen is noodzakelijk. 50.000 items en 50MB zijn twee parallelle limieten; voldoen aan een van de overschrijdingsvoorwaarden vereist splitsing. U kunt splitsen op inhoudstype of de Sitemap vereenvoudigen (bijv. onnodige spaties, inspringingen verwijderen, gzip-compressie gebruiken), maar als het na compressie nog steeds groter is dan 50MB, moet u splitsen.

Kunnen noindex-pagina's of URL's die zijn geblokkeerd door robots.txt in Sitemaps worden opgenomen?

Niet aanbevolen. Sitemaps mogen alleen pagina's bevatten die u door zoekmachines wilt laten crawlen en indexeren. Noindex-pagina's, door Disallow verboden pagina's, pagina's waarvoor inloggen vereist is, 404-foutpagina's mogen niet in Sitemaps voorkomen; dit verlaagt het vertrouwen van zoekmachines in Sitemaps en verspilt crawlbudget.

Moet Sitemap opnieuw worden ingediend na inhoudsupdate? Hoe vaak moet een Sitemap worden bijgewerkt?

Zolang de URL van het Sitemap-bestand ongewijzigd blijft, zullen zoekmachines periodiek opnieuw crawlen; u hoeft niet elke keer dat inhoud wordt bijgewerkt handmatig opnieuw in te dienen. De updatefrequentie is afhankelijk van de inhoudsupdatefrequentie van uw website: nieuwssites kunnen dagelijks of zelfs elk uur Sitemaps bijwerken (automatisch gegenereerd), bedrijfssites kunnen wekelijks of maandelijks bijwerken. U kunt een serverzijde script configureren om het Sitemap-bestand automatisch bij te werken.

Welke talen URL's ondersteunt Sitemap? Vereisen meertalige URL's codering?

Sitemap ondersteunt URL's in elke taal, maar URL's met niet-ASCII-tekens (zoals Nederlandse tekens) vereisen URL-codering (ook wel percentcodering genoemd, percent-encoding). Speciale tekens moeten worden gecodeerd in de juiste procentvorm. De meeste browsers en tools verwerken dit automatisch, maar u moet ervoor zorgen dat URL's in de gegenereerde Sitemap correct zijn gecodeerd.

Kunnen meerdere Sitemaps tegelijk worden ingediend? Bijv. tegelijk een artikel-Sitemap en een product-Sitemap hebben?

Ja, er zijn twee manieren: ①gebruik een Sitemap Index-indexbestand om alle sub-Sitemaps uniform te beheren, dit is de aanbevolen manier, u hoeft alleen de indexbestand-URL in te dienen; ②dien de URL van elke sub-Sitemap afzonderlijk in op het webmasterplatform, deze manier werkt ook maar is lastiger te beheren. Beide manieren zijn effectief en zoekmachines zullen ze crawlen.

Is gzip-compressie vereist na het genereren van een Sitemap? Wat zijn de voordelen van compressie?

Compressie is niet vereist, maar wordt sterk aanbevolen. gzip-compressie verkleint de Sitemap-grootte meestal met 70%-80%, wat bandbreedte en crawlerdownloadtijd bespaart, vooral bij grote websites is het effect duidelijk. Zoekmachines ondersteunen het gecomprimeerde formaat sitemap.xml.gz volledig en decomprimeren automatisch. Zolang het na compressie niet groter is dan 50MB, is er geen probleem.

Moeten voor zowel HTTP- als HTTPS-versies van de website Sitemaps worden ingediend?

U dient alleen de voorkeursversie in die u wilt indexeren. Als de hele site al HTTPS is en er een 301-omleiding HTTP→HTTPS is ingesteld, hoeft u alleen de HTTPS-versie van de Sitemap in te dienen. Dien niet zowel HTTP- als HTTPS-versies tegelijk in; dit veroorzaakt problemen met dubbele inhoud. Evenzo moeten www en non-www ook een voorkeursdomein bepalen en alleen de Sitemap van het voorkeursdomein indienen.

WordPress heeft een Sitemap gegenereerd met Yoast SEO, heb ik deze tool nog steeds nodig?

Yoast SEO kan automatisch Sitemaps genereren voor de meeste pagina's, maar kan sommige pagina's missen — bijvoorbeeld handmatig gemaakte enkele pagina's, niet zorgvuldig geconfigureerde aangepaste posttypes, speciale bestemmingspagina's, van buiten geïmporteerde pagina's, enz. U kunt deze tool gebruiken om die URL's aan te vullen die niet door Yoast worden gedekt, een afzonderlijke aanvullende Sitemap genereren of vergelijken en controleren of de door Yoast gegenereerde Sitemap compleet en correct is.

Is de volgorde van URL's in Sitemap belangrijk? Is het nuttig om belangrijke pagina's vooraan te zetten?

In het Sitemap-protocol heeft de URL-volgorde geen officieel gewicht; zoekmachines zullen niet alleen prioriteit geven aan crawlen omdat URL's vooraan staan. Sommige SEO-beoefenaars hebben echter een klein volgordevoorkeurseffect waargenomen, dus het plaatsen van belangrijke URL's vooraan kan geen kwaad, maar verwacht niet dat dit een duidelijk effect oplevert; u moet nog steeds de prioriteit correct identificeren via het priority-veld.

Moeten gepagineerde pagina's (zoals /list?page=2, /page/3) in Sitemap worden opgenomen?

Dit hangt af van de waarde van de gepagineerde inhoud. Als paginering een herhalende lijst van het type "bekijk meer" is (bijv. tweede pagina van een artikellijst, derde pagina), wordt meestal niet aanbevolen deze in Sitemap op te nemen, omdat deze pagina's dubbele inhoud en lage waarde hebben; de focus moet liggen op de lijsthomepage en specifieke artikelpagina's. Als paginering echter unieke inhoud heeft (bijv. categorieweergave, paginering heeft onafhankelijke waarde), kunt u overwegen deze op te nemen met een lagere priority.

Hoe te verifiëren of een Sitemap correct en effectief is?

Er zijn verschillende verificatiemethoden: ①na het genereren met deze tool bekijkt u eerst lokaal of de XML-structuur correct is, controleert of tagsluiting, naamruimte, coderingstekens normaal zijn; ②gebruik de sitemap-inspector tool om het formaat en de URL-toegankelijkheid online te verifiëren, controleer batchgewijs de HTTP-statuscodes van alle URL's; ③na uploaden krijgt u direct toegang tot de Sitemap-URL in de browser om te controleren of deze correct wordt weergegeven zonder XML-parseerfouten; ④na indiening bij Google Search Console/Bing Webmaster Tools bekijkt u het statusrapport om te controleren of er formaatfouten, niet-toegankelijke URL's, limietoverschrijdingen en andere foutmeldingen zijn; dit is de meest gezaghebbende verificatiemethode; ⑤u kunt ook online XML-verificatietools gebruiken om de XML-syntaxiscorrectheid te controleren.

Probleemoplossing

Gegenereerde Sitemap XML toont een parseerfout bij openen in de browser, wat wijst op een onjuist formaat

URL's bevatten XML-speciale tekens zoals &, <, > zonder escaping: de tool escapest automatisch bij plakken, maar als u het bestand handmatig hebt bewerkt, hebt u mogelijk escaping overgeslagen XML-verklaring of urlset-naamruimte onjuist geschreven: controleer of de xmlns-waarde op de eerste regel exact overeenkomt met http://www.sitemaps.org/schemas/sitemap/0.9 zonder extra schuine strepen Tags niet correct gesloten: alle openingstags zoals <url>, <loc> moeten bijbehorende sluitingstags </url>, </loc> hebben; zelfsluitende tagsyntaxis moet correct zijn Bestandscodering is niet UTF-8 zonder BOM: Windows Kladblok kan opslaan als UTF-8 BOM of andere codering, wat parseerfouten veroorzaakt; opslaan als UTF-8 zonder BOM URL's bevatten ongeldige tekens: meertalige URL's vereisen URL-codering (percentcodering); niet-gecodeerde speciale tekens veroorzaken XML-parseerfouten XML-versieverklaringfout: eerste regel moet <?xml version="1.0" encoding="UTF-8"?> zijn; schrijf geen 1.1 of andere versies Tag nestvolgorde fout: onderliggende tags moeten volledig zijn opgenomen in bovenliggende tags; kruisnesten zoals <url><loc></url></loc> is een onjuiste volgorde

Google Search Console toont "Kan Sitemap niet ophalen" of "Formaatfout" na Sitemap-indiening

Sitemap-bestand-URL niet toegankelijk: controleer of directe toegang tot de Sitemap-URL in de browser een 200-statuscode retourneert zonder 403/404/500-fouten Server retourneerde onjuiste Content-Type: moet application/xml of text/xml retourneren; het retourneren van text/html veroorzaakt herkenningsfouten Sitemap bevat URL's die zijn geblokkeerd door robots.txt: GSC meldt fouten wanneer het Disallow-paden detecteert in de Sitemap URL-omleidingsproblemen: Sitemap-URL's die 301/302 omleiden naar andere adressen veroorzaken fouten; zorg ervoor dat URL's direct toegankelijk zijn zonder omleidingen HTTP/HTTPS of www/non-www mismatch: ingediende Sitemap-domein komt niet overeen met het domein dat is geverifieerd in GSC (bijv. geverifieerd www.example.com maar Sitemap gebruikt example.com) Sitemap-bestand is te groot en overschrijdt de 50MB-limiet of URL's overschrijden 50.000 items: GSC zal de verwerking van overlimietbestanden direct weigeren HTML-entiteiten gebruikt in plaats van XML-entiteiten: &nbsp; voor spaties is een HTML-entiteit, geen XML-entiteit, en kan niet in XML worden gebruikt

Lang na Sitemap-indiening zijn veel URL's nog steeds niet geïndexeerd door Google

Paginakwaliteitsproblemen: indexering is niet gegarandeerd bij indiening; pagina's met slechte originaliteit, dubbele inhoud of lage inhoudswaarde kunnen door Google worden gekozen om niet te indexeren Nieuwe sitebeoordelingsperiode (sandbox-effect): nieuwe websites hebben mogelijk een observatieperiode van enkele weken tot enkele maanden na Sitemap-indiening nodig voordat bulkindexering plaatsvindt Pagina's zijn noindex: pagina's retourneren noindex-metatags of X-Robots-Tag: noindex-antwoordheaders; Google zal ze actief uitsluiten Onvoldoende website-crawlbudget: lage site-autoriteit, trage serverrespons, slechte interne linkstructuur resulteren in lage crawlfrequentie toegewezen door Google-crawlers, wat meer tijd vereist Sitemap bevat veel laagwaardige URL's: als veel URL's in de Sitemap 404's, 5xx-fouten, dubbele inhoud of laagwaardige pagina's zijn, zal Google het vertrouwen in de hele Sitemap verminderen Domein bestraft: website heeft problemen die de Google-kwaliteitsrichtlijnen schenden (zoals spam, geschraapte inhoud, malware) waardoor indexering wordt geblokkeerd Pagina's zijn geïsoleerde pagina's: hoewel pagina's in de Sitemap staan, zijn er geen ingangen vanaf interne websitelinks; crawlers kunnen ze als onbelangrijk beschouwen en ze niet indexeren

Sitemap toont ontdekte URL's, maar werkelijke geïndexeerde aantal is erg laag

Dit is normaal: "Ontdekt" betekent alleen dat Google de Sitemap heeft bezocht en de URL's heeft gezien, niet dat ze allemaal worden geïndexeerd; indexeringssnelheid is afhankelijk van paginakwaliteit Problemen met dubbele inhoud: meerdere URL's met zeer vergelijkbare inhoud (zoals dezelfde pagina met verschillende parameters, afdrukversies, paginering) zorgen ervoor dat Google één canonieke versie kiest om te indexeren Canonieke tag die naar andere pagina's verwijst: pagina heeft <link rel="canonical" href="andere URL"> ingesteld; Google indexeert het adres waarnaar canonieke verwijst Pagina-inhoud is te dun: te weinig woorden, geen wezenlijke waarde, geschraapte inhoud — Google vindt het niet de moeite waard om te indexeren Pagina-laadsnelheid is te laag: serverreactietime-out, pagina's die te langzaam laden; crawlers verlagen de crawlprioriteit na meerdere mislukte ophaalacties HTTPS-certificaatproblemen: ongeldige SSL-certificaten, gemengde-inhoudsfouten, naast elkaar bestaande HTTP/HTTPS-versies die canonieke problemen veroorzaken Problemen met mobiele aanpassing: slechte mobielvriendelijkheid, fouten in mobiele aanpassing beïnvloeden indexering in een mobile-first indexeringsomgeving

Bing kan Sitemap normaal crawlen, maar Google crawlt helemaal niet

Google Search Console-verificatieproblemen: bevestig dat domeineigendomsverificatie geldig is en het geverifieerde domein (www/non-www, http/https) overeenkomt met de werkelijke toegangsversie Serverfirewall of CDN blokkeert Googlebot: controleer servertoegangslogboeken om te zien of Googlebot-verzoeken (user-agent met Googlebot) worden geblokkeerd of 403 retourneren DNS-resolutieproblemen: Google's DNS-resolutie naar andere IP-adressen dan Bing; zorg ervoor dat alle regio's correct naar uw server kunnen resolven robots.txt heeft speciale beperkingen voor Googlebot: controleer of er speciale Disallow-regels zijn onder User-agent: Googlebot Website had eerdere cheatgeschiedenis die door Google is bestraft: domeinen die handmatige acties hebben ontvangen, moeten eerst een heroverweging aanvragen Sitemap-URL bevat inhoud die Google als onveilig beschouwt: zoals domeinen die zijn gemarkeerd voor malware of phishing-inhoud CDN WAF-regels veroorzaken valse positieven: sommige beveiligingsregels kunnen Googlebot-crawlergedrag verkeerd identificeren; controleer CDN-beveiligingslogboeken

Gegenereerde Sitemap test lokaal prima, maar toegang ertoe na serverupload retourneert een 404-fout

Onjuist bestandspad: sitemap.xml is niet geüpload naar de juiste map; bevestig dat het is geüpload naar de locatie die overeenkomt met de URL die u in robots.txt hebt gedeclareerd en bij zoekmachines hebt ingediend Problemen met bestandsnaam hoofdlettergevoeligheid: Linux/Unix-servers zijn hoofdlettergevoelig; Sitemap.xml en sitemap.xml zijn verschillende bestanden; zorg ervoor dat de bestandsnaam volledig in kleine letters is Nginx/Apache-configuratie blokkeert toegang tot xml-bestanden: controleer de serverconfiguratie op locatie-regels die toegang tot .xml-bestandsextensies weigeren of onjuiste try_files-regels Bestandsrechtenproblemen: onjuiste bestandsrechten op de server (zoals 600-rechten) waarbij de webservergebruiker geen leesrechten heeft; meestal zijn 644-rechten vereist, mappen hebben 755-rechten nodig CDN heeft oude 404-reactie in cache: nieuw geüploade bestanden hebben mogelijk nog steeds de vorige 404 in CDN-cache; u moet de CDN-cache vernieuwen of wachten tot CDN automatisch de bron vernieuwt Conflicten met permalinkregels in WordPress of een ander CMS: CMS-herschrijfregels onderscheppen sitemap.xml; u moet uitsluitingsregels configureren zodat de server direct toegang heeft tot statische bestanden Server heeft hotlinkbeveiliging of toegangscontrole geconfigureerd: referer-controles, IP-whitelists of andere regels in .htaccess- of Nginx-configuratie kunnen crawlertoegang blokkeren

Woordenlijst

Sitemap
Een XML-protocolstandaardbestand dat zoekmachines informeert over alle crawlbare pagina's op een website, met een volledige URL-lijst en metadata voor elke URL. Helpt crawlers zoals Googlebot en Bingbot website-inhoud intelligenter en efficiënter te ontdekken, begrijpen en crawlen. Onderhouden door de sitemaps.org-organisatie als een uniform open protocolstandaard (huidige versie 0.9).
urlset
Het root-element van een standaard Sitemap XML-bestand, dat de juiste xmlns-naamruimtedeclaratie moet bevatten en alle <url> onderliggende elementitems moet nesten. De kernidentificatie van Sitemap-geldigheid — Sitemaps zonder een correcte urlset-structuur worden direct door zoekmachines geweigerd voor parsing.
Sitemap Index
Een sitemapindexbestand dat moet worden gebruikt wanneer het aantal URL's van een website meer dan 50.000 items bedraagt of een enkel Sitemap-bestand groter is dan 50MB. Het root-element is <sitemapindex>, gebruikt om meerdere sub-Sitemapbestandsadressen uniform te vermelden en te beheren, en is de standaardoplossing voor het splitsen van Sitemaps op grote websites.
changefreq
Een optioneel metadata-element in Sitemap dat wordt gebruikt om de geschatte updatefrequentie van pagina-inhoud te specificeren. Heeft zeven geldige waarden: always, hourly, daily, weekly, monthly, yearly en never. Verstrekt als referentie voor zoekmachinecrawlers om herhalingscrawlfrequentie te plannen; juiste instelling kan crawlbudgettoewijzing optimaliseren.
priority
Een optioneel metadata-element in Sitemap dat wordt gebruikt om de belangrijkheidsprioriteit van een URL ten opzichte van andere pagina's binnen de website te specificeren. Neemt een decimale waarde tussen 0.0 en 1.0 met een standaard van 0.5. priority beïnvloedt alleen de relatieve crawlprioriteit tussen pagina's binnen een site en beïnvloedt geen zoekresultaatranglijsten.
lastmod
Een optioneel metadata-element in Sitemap dat de datum en tijd van de laatste inhoudelijke wijziging van een pagina registreert. Het formaat moet voldoen aan de W3C Datetime-specificatie. Het is het belangrijkste van de drie optionele metadatavelden voor zoekmachines, omdat het direct aangeeft of een pagina nieuwe inhoud heeft die opnieuw moet worden gecrawld.
loc
Een verplicht onderliggend element onder <url>-elementen dat wordt gebruikt om het volledige absolute URL-adres van een pagina te specificeren. Moet beginnen met het http:// of https:// protocol, de volledige domeinnaam bevatten, totale URL-lengte mag niet meer dan 2048 tekens zijn, en relatieve paden zijn niet toegestaan.
XML-naamruimte (xmlns)
Een XML-naamruimteattribuut dat moet worden gedeclareerd op het urlset-root-element. De attribuutwaarde moet exact overeenkomen met http://www.sitemaps.org/schemas/sitemap/0.9 om de protocolversie te identificeren die door de Sitemap wordt gebruikt. Ontbrekende of onjuist geschreven naamruimten veroorzaken Sitemap-parseerfouten.
W3C Datetime
Datum- en tijdweergaveformaat gespecificeerd door W3C (World Wide Web Consortium). Het lastmod-veld in Sitemaps moet aan dit formaat voldoen. Het vereenvoudigde datumformaat YYYY-MM-DD wordt vaak gebruikt (beste compatibiliteit), en het volledige datum-tijdformaat met uren, minuten, seconden en tijdzone-informatie wordt ook ondersteund.
XML Entiteit Escaping
In XML-syntaxis moeten speciale tekens worden ge-escaped naar bijbehorende entiteitsverwijzingen voor correcte parsing: & escaped naar &amp;, < escaped naar &lt;, > escaped naar &gt;, " escaped naar &quot;, ' escaped naar &apos;. URL's die deze tekens bevatten, moeten worden ge-escaped, anders treden er XML-parseerfouten op.
Google Search Console (GSC)
Google's officiële webmasterplatformtool die wordt gebruikt voor het indienen van Sitemaps, het bekijken van website-indexstatus, analyse van zoekverkeersgegevens, crawlfoutrapporten, beveiligingsprobleemmeldingen, handmatige actiestrafmeldingen, enz. Een essentieel hulpmiddel voor Google-zoekmachineoptimalisatie (SEO).
Bing Webmaster Tools
De officiële webmasterplatform van Microsoft Bing-zoekmachine met functionaliteit vergelijkbaar met Google Search Console. Ondersteunt Sitemap-indiening, indexdekkingsstatistieken, SEO-diagnoseanalyse, trefwoordonderzoek, backlinkquery's, enz., voor zoekverkeer van zowel Bing- als Yahoo-zoekmachines.
robots.txt
Een tekstbestand dat in de hoofdmap van een website wordt geplaatst en richtlijnen zoals User-agent, Disallow en Allow gebruikt om zoekmachinecrawlers te vertellen welke paden mogen worden gecrawld en welke paden verboden zijn. Het kan ook Sitemap-bestandslocaties in het bestand declareren voor automatische ontdekking door crawlers.
Crawler (Spider/Bot)
Geautomatiseerde programma's ontwikkeld door zoekmachines om webinhoud op te halen, zoals Googlebot (Google-crawler), Bingbot (Bing-crawler) en Baiduspider (Baidu-crawler). Ze ontdekken nieuwe pagina's door paginalinks te volgen en Sitemap-bestanden te lezen, paginainhoud te downloaden en op te slaan in zoekmachine-indexdatabases.
Crawlbudget
De totale hoeveelheid crawlresource die door zoekmachines aan een website wordt toegewezen binnen een bepaalde periode, bepaald door meerdere factoren, waaronder domeinautoriteit, serverresponssnelheid, paginainhoudskwaliteit en historische crawleffectiviteit. Correcte Sitemap-configuratie kan helpen de efficiëntie van crawlbudgetgebruik te optimaliseren.
UTF-8-codering
De tekencodering die verplicht is voor Sitemap XML-bestanden. UTF-8 ondersteunt alle Unicode-tekens, inclusief Nederlandse tekens, gespecificeerd in de XML-verklaring via het encoding="UTF-8"-attribuut. Het gebruik van andere coderingen kan karaktervertekening en parseerfouten veroorzaken in meertalige URL's.
gzip-compressie
Het Sitemap-protocol ondersteunt compressietransfer met het gzip-algoritme (bestandsextensie .xml.gz), waardoor de Sitemap-bestandsgrootte met 70%-80% kan worden verkleind, wat serverbandbreedte en crawlerdownloadtijd aanzienlijk bespaart. Grote zoekmachines kunnen gzip-gecomprimeerde Sitemap-bestanden automatisch decomprimeren en verwerken; gecomprimeerde bestanden moeten nog steeds voldoen aan de 50MB-groottebeperking.
Yoast SEO
Een veelgebruikte SEO-plug-in op CMS-platforms zoals WordPress en Shopify die automatisch Sitemaps, meta-tags, broodkruimelnavigatie, XML-sitemaps, RSS-optimalisatie, social media-metadata en andere SEO-gerelateerde functies kan genereren. Een veelgebruikte SEO-oplossing voor op inhoud gerichte websites.
Indexdekking
Een van de kernrapporten in Google Search Console, met gedetailleerde aantallen en redenen van pagina's die zijn geïndexeerd, uitgesloten, met fouten en met waarschuwingen op een website. Kan worden gebruikt om Sitemap-indieningseffectiviteit te verifiëren en paginaindexeringsproblemen te diagnosticeren.
URL-codering (Percentcodering)
Ook wel percentcodering genoemd, een coderingsmethode die wordt gebruikt om niet-ASCII-tekens (zoals Nederlandse tekens en speciale symbolen) in URL's weer te geven. Speciale tekens worden gecodeerd in de vorm %XX%XX%XX. Meertalige URL's in Sitemaps moeten correct worden gecodeerd om te worden geparseerd.

changefreq Updatefrequentie Scenario Referentietabel

changefreq-waardeUpdatefrequentieTypische toepasselijke paginatypesOpmerkingen
alwaysKan bij elk bezoek veranderenRealtime gegevenspagina's, zoekingangen, dynamische aggregatiepagina'sBetekent niet dat crawlers elke keer komen, geeft alleen extreem hoge wijzigingsfrequentie aan; misbruik niet — gewone pagina's mogen niet op always worden ingesteld
hourlyWordt elk uur bijgewerktNieuwshomepages, social media-feeds, realtime prijspagina'sGeschikt voor pagina's met elk uur nieuwe inhoud; niet-hoogfrequente sites mogen niet op hourly worden ingesteld
dailyWordt dagelijks bijgewerktWebsitehomepage, bloglijstpagina's, nieuwskanaalpagina's, productcategoripagina'sEen van de meest gebruikte waarden; geschikt voor de meeste sitehomepages en sectiepagina's
weeklyWordt wekelijks bijgewerktGewone artikeldetailpagina's, productdetailpagina's, blogberichtpagina'sGeschikt voor inhoudspagina's op de meeste op inhoud gerichte websites
monthlyWordt maandelijks bijgewerktCategorimappagina's, archiefpagina's, FAQ-pagina's, gebruikershandleidingpagina'sHulppagina's met onregelmatige inhoudsupdates maar incidentele aanpassingen
yearlyWordt jaarlijks bijgewerktBedrijfsintroductiepagina's, contactpagina's, servicevoorwaarden, privacybeleidStatische informatiepagina's die bijna nooit veranderen
neverWordt nooit bijgewerktHistorische artikelarchieven, verlopen evenementenpagina's, gearchiveerde oude inhoudStel pagina's die niet meer worden gewijzigd in op never; vergeet ze onmiddellijk terug te zetten als er updates zijn

priority Prioriteitsinstelling Referentietabel

priority-waardePrioriteitsniveauToepasselijke paginatypesAanbevolen pagina-aantal verhouding
1.0HoogsteWebsitehomepage, kernbestemmingspagina's, belangrijkste kanaalingangenSlechts 1-3 pagina's over de hele site
0.8-0.9Zeer hoogHoofdsectiepagina's, populaire categoripagina's, kernproductpagina's, belangrijke speciale onderwerpenOngeveer 5-10% van alle pagina's
0.6-0.7HoogSecundaire sectiepagina's, subcategoripagina's, populaire artikelen, belangrijke productdetailsOngeveer 10-20% van alle pagina's
0.4-0.5NormaalGewone artikeldetailpagina's, algemene productpagina's, standaard inhoudspagina'sOngeveer 40-60% van alle pagina's (standaardwaarde)
0.2-0.3LaagTagpagina's, archiefpaginering, oude artikelarchieven, hulppagina'sOngeveer 15-25% van alle pagina's
0.0-0.1LaagsteLaagwaardige pagina's, dubbele inhoudspagina's, pagina's die niet prioriteit krijgen om te crawlenBinnen ongeveer 5% van alle pagina's; 0 betekent niet noindex

Sitemap Protocolspecificatie Limiettabel

LimietitemBovengrensBeschrijvingOverschrijdingsoplossing
URL's per enkele Sitemap50.000 itemsVaste vereiste van het sitemap.org 0.9-protocolGebruik Sitemap Index om te splitsen in meerdere sub-Sitemaps
Niet-gecomprimeerde grootte van enkel Sitemap-bestand50MB (52428800 bytes)Ruwe bestandsgrootte inclusief alle tags en witruimteGebruik gzip-compressie, splits Sitemaps, minimaliseer opmerkingen
Sub-Sitemaps per Sitemap Index50.000 itemsURL-itemlimiet voor het indexbestand zelfTheoretisch ondersteunt het 2,5 miljard URL's; onnodig voor de meeste sites
Lengte van enkele URL2.048 tekensInclusief protocol, domein, pad en alle queryparametersTe lange URL's vereisen parametervereenvoudiging of URL-herschrijving
Door Sitemap ondersteunde coderingUTF-8Verplicht door protocol; andere coderingen kunnen parseerfouten veroorzakenZorg ervoor dat bestanden worden opgeslagen met UTF-8-codering
Door Sitemap ondersteunde protocollenhttp:// of https://URL's moeten een volledig protocolvoorvoegsel bevattenftp:// en andere protocollen worden niet ondersteund
Crawlerresponstijd na indieningEnkele uren tot enkele dagenAfhankelijk van site-autoriteit en Sitemap-complexiteitNiet nodig om opnieuw in te dienen; wacht geduldig op verwerking
gzip-gecomprimeerde bestandsgrootte50MBGecomprimeerde bestanden mogen ook de limiet van 50MB niet overschrijdenOverschrijding na compressie vereist nog steeds Sitemap-splitsing