Sitemap Generator
sitemap.xml Generator
Voer een URL-lijst in, stel changefreq, priority en lastmod globaal in, genereer sitemap.org-conforme XML-sitemaps in één klik.
Genereer online Sitemap XML-websitekaartbestanden die voldoen aan de open sitemap.org 0.9-protocolstandaard. Ondersteunt volledige configuratie van 7 changefreq updatefrequenties, priority 0.0-1.0 relatieve prioriteitsniveaus en lastmod datumkiezer. Bevat automatische XML-entiteit escaping, realtime detectie van ongeldige URL's, live gestructureerd XML-voorbeeld en eenklik download- en kopieerfuncties, waardoor grote zoekmachines waaronder Google en Bing snel alle belangrijke pagina's op uw website kunnen ontdekken en efficiënt indexeren.
Gerelateerde aanbevelingen
Toepassingsgevallen
- Genereer batchgewijs Sitemaps voor kernpagina's na de lancering van een nieuwe website en dien deze in bij Google Search Console en Bing Webmaster Tools om zoekmachineontdekking en indexering te versnellen
- Genereer sitemaps opnieuw na herontwerpen van websitesecties of wijzigingen in de URL-structuur om zoekmachine-indexen bij te werken en te voorkomen dat verbroken links de SEO-prestaties beïnvloeden
- Importeer batchgewijs productlijst-URL's voor e-commercewebsites, waarbij verschillende changefreq- en priority-waarden worden ingesteld op basis van productcategorieën en plaatsingsdatums
- Genereer meerdere Sitemaps gesplitst per kanaal voor grote portals of nieuwssites die meer dan 50.000 URL's bevatten en maak een Sitemap Index-bestand
- Configureer geschikte updatefrequenties en prioriteitsparameters voor artikelpagina's, tagpagina's, categoripagina's en archiefpagina's op blogwebsites
- Organiseer verschillende URL-types voor bedrijfswebsites, waaronder productpagina's, nieuwspagina's, over-pagina's en contactpagina's, met gedifferentieerde lastmod- en priority-waarden
- Genereer en dien Sitemaps opnieuw na websitemigratie (HTTP naar HTTPS-upgrade, domeinnaamwijziging) om crawlers te begeleiden bij het snel ophalen van nieuwe adressen
- Vul Sitemaps die zijn gegenereerd door plug-ins zoals Yoast SEO handmatig aan, door speciale pagina-URL's toe te voegen die niet door de plug-in worden gedekt
- Genereer Sitemaps opnieuw na SEO-diagnose en -optimalisatie om ervoor te zorgen dat belangrijke pagina's redelijke priority-instellingen hebben, waardoor de crawlgewicht voor hoogwaardige pagina's wordt verhoogd
- Valideer de XML-formaatcorrectheid met deze tool voordat u de Sitemap-locatie in robots.txt declareert om crawler-parseerfouten te voorkomen
Hoe te gebruiken
- Plak de lijst met pagina-adressen die moeten worden geïndexeerd in het URL-invoergebied, één volledige URL per regel (moet het http:// of https:// protocolvoorvoegsel bevatten)
- Selecteer de pagina-updatefrequentie in het changefreq dropdown-menu: kies daily of hourly voor de startpagina, weekly voor artikelpagina's, yearly of monthly voor statische pagina's
- Sleep de priority-schuifregelaar of voer een waarde tussen 0.0-1.0 in om de prioriteit in te stellen: stel de kernstartpagina in op 1.0, belangrijke sectiepagina's op 0.8, gewone artikelpagina's op 0.5, archiefpagina's op 0.3
- Klik op de lastmod datumkiezer om de laatste wijzigingsdatum van de website-inhoud te selecteren, of laat het leeg om het lastmod-veld niet op te nemen
- Controleer het realtime voorbeeldgebied aan de rechterkant om te verifiëren dat de gegenereerde XML-structuur correct is; ongeldige URL's worden rood gemarkeerd voor correctie
- Klik na bevestiging van correctheid op de knop "Download sitemap.xml" om het bestand op te slaan, of klik op de knop "Kopiëren" om de XML-inhoud naar het klembord te kopiëren
- Upload sitemap.xml naar de hoofdmap van de website, voeg een Sitemap-verklaring toe in robots.txt, of dien direct in bij Google Search Console/Bing Webmaster
Functies
- Batchgewijze URL-invoerondersteuning: één URL per regel, met automatische filtering van lege regels en dubbele links voor snelle verwerking van grote batches pagina-adressen
- Automatische XML-entiteit escaping: Speciale tekens in URL's, waaronder &, <, >, ", en ', worden automatisch ge-escaped naar &, <, >, ", en ', waardoor XML-parseerfouten volledig worden geëlimineerd
- 7 changefreq updatefrequentie-opties: always, hourly, daily, weekly, monthly, yearly, never — voor alle paginatypescenario's
- Gedetailleerde priority-instellingen: ondersteunt elke waarde tussen 0.0 en 1.0 met één decimaal nauwkeurigheid, waardoor onderscheid kan worden gemaakt tussen paginabelangrijkheidsniveaus
- lastmod laatste wijzigingsdatumkiezer: visuele kalenderkiezer die automatisch formatteert naar het W3C Datetime standaardformaat (YYYY-MM-DD)
- Realtime detectie van ongeldige URL's: identificeert automatisch onjuist opgemaakte URL's (ontbrekend protocol, ongeldige tekens, enz.) en markeert probleemregelnummers voor eenvoudige correctie
- Realtime voorbeeldgeneratie: XML-inhoud wordt onmiddellijk bijgewerkt wanneer URL-lijsten of configuratieparameters worden gewijzigd — geen handmatige klik op de genereerknop nodig
- Eenklik download van sitemap.xml: gegenereerde resultaten worden direct gedownload als standaard XML-bestand, klaar voor onmiddellijke upload naar een webserver na opslaan
- URL-limietwaarschuwing: geeft automatisch een melding voor Sitemap Index splitsing wanneer het aantal ingevoerde URL's 50.000 items bereikt
- Kopiëren naar klembord: eenklik kopiëren van volledige XML-inhoud naar het klembord voor eenvoudig plakken in serverbestanden of online indiening
- Bytegrootte-statistieken: toont realtime het aantal bytes van het gegenereerde Sitemap XML-bestand om te beoordelen of de bestandsgrootte voldoet aan de zoekmachinelimieten
- Standaard urlset root-elementuitvoer: voldoet strikt aan de http://www.sitemaps.org/schemas/sitemap/0.9 protocolspecificatie met correcte xmlns-naamruimtedeclaratie
- UTF-8-coderingsdeclaratie: voegt automatisch een XML-coderingsdeclaratie toe om ervoor te zorgen dat meertalige URL's correct worden geparseerd zonder tekencorruptie
Veelgestelde vragen
Is Sitemap-indiening verplicht? Wordt mijn site niet geïndexeerd zonder indiening?
Uw site kan ook zonder Sitemap-indiening worden geïndexeerd — zoekmachines kunnen uw pagina's ontdekken via externe links van andere sites en het volgen van interne links. Het indienen van een Sitemap kan de ontdekkingssnelheid echter aanzienlijk versnellen, vooral voor nieuwe sites, grote sites en sites met onvolmaakte interne links. Google raadt officieel aan dat alle websites Sitemaps indienen; het is basis SEO-werk met zeer lage kosten en hoge baten.
Moeten URL's in Sitemaps absolute paden zijn? Kunnen relatieve paden worden gebruikt?
Het moeten volledige absolute URL's zijn, met protocolvoorvoegsel (http:// of https://) en volledige domeinnaam; er kunnen geen relatieve paden (zoals /page1.html) of notaties zonder protocol worden gebruikt. Zoekmachines hebben de volledige URL nodig bij het parseren van Sitemaps om correct te crawlen; relatieve paden veroorzaken parseerfouten.
Zijn changefreq- en priority-instellingen echt nuttig? Volgen zoekmachines ze?
Beide velden zijn "aanwijzingen", geen "richtlijnen"; zoekmachines zullen ze niet noodzakelijk voor 100% volgen, maar nauwkeurige instelling heeft nog steeds referentiewaarde. Ter vergelijking: lastmod (laatste wijzigingstijd) is het belangrijkste van de drie velden voor zoekmachines, omdat het crawlers direct kan vertellen of een pagina nieuwe inhoud heeft. Vervals niet door alle pagina's op de hoogste prioriteit of always in te stellen; hierdoor zullen zoekmachines deze metadata niet meer vertrouwen.
Moet het Sitemap-bestand in de hoofdmap van de website worden geplaatst?
Niet noodzakelijk; Sitemap kan op elk pad in de website worden geplaatst, zolang de URL normaal toegankelijk is. robots.txt moet echter in de hoofdmap worden geplaatst. Als u Sitemap Index gebruikt om meerdere Sitemaps te splitsen, hebben paden van sub-Sitemaps geen beperkingen. Het is echter gebruikelijk om het in de hoofdmap te plaatsen, wat het handigst is voor beheer en crawlers het gemakkelijkst maakt om het te ontdekken.
Wat te doen als het aantal URL's van de website minder is dan 50.000, maar de bestandsgrootte groter is dan 50MB?
Sitemap splitsen is noodzakelijk. 50.000 items en 50MB zijn twee parallelle limieten; voldoen aan een van de overschrijdingsvoorwaarden vereist splitsing. U kunt splitsen op inhoudstype of de Sitemap vereenvoudigen (bijv. onnodige spaties, inspringingen verwijderen, gzip-compressie gebruiken), maar als het na compressie nog steeds groter is dan 50MB, moet u splitsen.
Kunnen noindex-pagina's of URL's die zijn geblokkeerd door robots.txt in Sitemaps worden opgenomen?
Niet aanbevolen. Sitemaps mogen alleen pagina's bevatten die u door zoekmachines wilt laten crawlen en indexeren. Noindex-pagina's, door Disallow verboden pagina's, pagina's waarvoor inloggen vereist is, 404-foutpagina's mogen niet in Sitemaps voorkomen; dit verlaagt het vertrouwen van zoekmachines in Sitemaps en verspilt crawlbudget.
Moet Sitemap opnieuw worden ingediend na inhoudsupdate? Hoe vaak moet een Sitemap worden bijgewerkt?
Zolang de URL van het Sitemap-bestand ongewijzigd blijft, zullen zoekmachines periodiek opnieuw crawlen; u hoeft niet elke keer dat inhoud wordt bijgewerkt handmatig opnieuw in te dienen. De updatefrequentie is afhankelijk van de inhoudsupdatefrequentie van uw website: nieuwssites kunnen dagelijks of zelfs elk uur Sitemaps bijwerken (automatisch gegenereerd), bedrijfssites kunnen wekelijks of maandelijks bijwerken. U kunt een serverzijde script configureren om het Sitemap-bestand automatisch bij te werken.
Welke talen URL's ondersteunt Sitemap? Vereisen meertalige URL's codering?
Sitemap ondersteunt URL's in elke taal, maar URL's met niet-ASCII-tekens (zoals Nederlandse tekens) vereisen URL-codering (ook wel percentcodering genoemd, percent-encoding). Speciale tekens moeten worden gecodeerd in de juiste procentvorm. De meeste browsers en tools verwerken dit automatisch, maar u moet ervoor zorgen dat URL's in de gegenereerde Sitemap correct zijn gecodeerd.
Kunnen meerdere Sitemaps tegelijk worden ingediend? Bijv. tegelijk een artikel-Sitemap en een product-Sitemap hebben?
Ja, er zijn twee manieren: ①gebruik een Sitemap Index-indexbestand om alle sub-Sitemaps uniform te beheren, dit is de aanbevolen manier, u hoeft alleen de indexbestand-URL in te dienen; ②dien de URL van elke sub-Sitemap afzonderlijk in op het webmasterplatform, deze manier werkt ook maar is lastiger te beheren. Beide manieren zijn effectief en zoekmachines zullen ze crawlen.
Is gzip-compressie vereist na het genereren van een Sitemap? Wat zijn de voordelen van compressie?
Compressie is niet vereist, maar wordt sterk aanbevolen. gzip-compressie verkleint de Sitemap-grootte meestal met 70%-80%, wat bandbreedte en crawlerdownloadtijd bespaart, vooral bij grote websites is het effect duidelijk. Zoekmachines ondersteunen het gecomprimeerde formaat sitemap.xml.gz volledig en decomprimeren automatisch. Zolang het na compressie niet groter is dan 50MB, is er geen probleem.
Moeten voor zowel HTTP- als HTTPS-versies van de website Sitemaps worden ingediend?
U dient alleen de voorkeursversie in die u wilt indexeren. Als de hele site al HTTPS is en er een 301-omleiding HTTP→HTTPS is ingesteld, hoeft u alleen de HTTPS-versie van de Sitemap in te dienen. Dien niet zowel HTTP- als HTTPS-versies tegelijk in; dit veroorzaakt problemen met dubbele inhoud. Evenzo moeten www en non-www ook een voorkeursdomein bepalen en alleen de Sitemap van het voorkeursdomein indienen.
WordPress heeft een Sitemap gegenereerd met Yoast SEO, heb ik deze tool nog steeds nodig?
Yoast SEO kan automatisch Sitemaps genereren voor de meeste pagina's, maar kan sommige pagina's missen — bijvoorbeeld handmatig gemaakte enkele pagina's, niet zorgvuldig geconfigureerde aangepaste posttypes, speciale bestemmingspagina's, van buiten geïmporteerde pagina's, enz. U kunt deze tool gebruiken om die URL's aan te vullen die niet door Yoast worden gedekt, een afzonderlijke aanvullende Sitemap genereren of vergelijken en controleren of de door Yoast gegenereerde Sitemap compleet en correct is.
Is de volgorde van URL's in Sitemap belangrijk? Is het nuttig om belangrijke pagina's vooraan te zetten?
In het Sitemap-protocol heeft de URL-volgorde geen officieel gewicht; zoekmachines zullen niet alleen prioriteit geven aan crawlen omdat URL's vooraan staan. Sommige SEO-beoefenaars hebben echter een klein volgordevoorkeurseffect waargenomen, dus het plaatsen van belangrijke URL's vooraan kan geen kwaad, maar verwacht niet dat dit een duidelijk effect oplevert; u moet nog steeds de prioriteit correct identificeren via het priority-veld.
Moeten gepagineerde pagina's (zoals /list?page=2, /page/3) in Sitemap worden opgenomen?
Dit hangt af van de waarde van de gepagineerde inhoud. Als paginering een herhalende lijst van het type "bekijk meer" is (bijv. tweede pagina van een artikellijst, derde pagina), wordt meestal niet aanbevolen deze in Sitemap op te nemen, omdat deze pagina's dubbele inhoud en lage waarde hebben; de focus moet liggen op de lijsthomepage en specifieke artikelpagina's. Als paginering echter unieke inhoud heeft (bijv. categorieweergave, paginering heeft onafhankelijke waarde), kunt u overwegen deze op te nemen met een lagere priority.
Hoe te verifiëren of een Sitemap correct en effectief is?
Er zijn verschillende verificatiemethoden: ①na het genereren met deze tool bekijkt u eerst lokaal of de XML-structuur correct is, controleert of tagsluiting, naamruimte, coderingstekens normaal zijn; ②gebruik de sitemap-inspector tool om het formaat en de URL-toegankelijkheid online te verifiëren, controleer batchgewijs de HTTP-statuscodes van alle URL's; ③na uploaden krijgt u direct toegang tot de Sitemap-URL in de browser om te controleren of deze correct wordt weergegeven zonder XML-parseerfouten; ④na indiening bij Google Search Console/Bing Webmaster Tools bekijkt u het statusrapport om te controleren of er formaatfouten, niet-toegankelijke URL's, limietoverschrijdingen en andere foutmeldingen zijn; dit is de meest gezaghebbende verificatiemethode; ⑤u kunt ook online XML-verificatietools gebruiken om de XML-syntaxiscorrectheid te controleren.
Probleemoplossing
Gegenereerde Sitemap XML toont een parseerfout bij openen in de browser, wat wijst op een onjuist formaat
URL's bevatten XML-speciale tekens zoals &, <, > zonder escaping: de tool escapest automatisch bij plakken, maar als u het bestand handmatig hebt bewerkt, hebt u mogelijk escaping overgeslagen XML-verklaring of urlset-naamruimte onjuist geschreven: controleer of de xmlns-waarde op de eerste regel exact overeenkomt met http://www.sitemaps.org/schemas/sitemap/0.9 zonder extra schuine strepen Tags niet correct gesloten: alle openingstags zoals <url>, <loc> moeten bijbehorende sluitingstags </url>, </loc> hebben; zelfsluitende tagsyntaxis moet correct zijn Bestandscodering is niet UTF-8 zonder BOM: Windows Kladblok kan opslaan als UTF-8 BOM of andere codering, wat parseerfouten veroorzaakt; opslaan als UTF-8 zonder BOM URL's bevatten ongeldige tekens: meertalige URL's vereisen URL-codering (percentcodering); niet-gecodeerde speciale tekens veroorzaken XML-parseerfouten XML-versieverklaringfout: eerste regel moet <?xml version="1.0" encoding="UTF-8"?> zijn; schrijf geen 1.1 of andere versies Tag nestvolgorde fout: onderliggende tags moeten volledig zijn opgenomen in bovenliggende tags; kruisnesten zoals <url><loc></url></loc> is een onjuiste volgorde
Google Search Console toont "Kan Sitemap niet ophalen" of "Formaatfout" na Sitemap-indiening
Sitemap-bestand-URL niet toegankelijk: controleer of directe toegang tot de Sitemap-URL in de browser een 200-statuscode retourneert zonder 403/404/500-fouten Server retourneerde onjuiste Content-Type: moet application/xml of text/xml retourneren; het retourneren van text/html veroorzaakt herkenningsfouten Sitemap bevat URL's die zijn geblokkeerd door robots.txt: GSC meldt fouten wanneer het Disallow-paden detecteert in de Sitemap URL-omleidingsproblemen: Sitemap-URL's die 301/302 omleiden naar andere adressen veroorzaken fouten; zorg ervoor dat URL's direct toegankelijk zijn zonder omleidingen HTTP/HTTPS of www/non-www mismatch: ingediende Sitemap-domein komt niet overeen met het domein dat is geverifieerd in GSC (bijv. geverifieerd www.example.com maar Sitemap gebruikt example.com) Sitemap-bestand is te groot en overschrijdt de 50MB-limiet of URL's overschrijden 50.000 items: GSC zal de verwerking van overlimietbestanden direct weigeren HTML-entiteiten gebruikt in plaats van XML-entiteiten: voor spaties is een HTML-entiteit, geen XML-entiteit, en kan niet in XML worden gebruikt
Lang na Sitemap-indiening zijn veel URL's nog steeds niet geïndexeerd door Google
Paginakwaliteitsproblemen: indexering is niet gegarandeerd bij indiening; pagina's met slechte originaliteit, dubbele inhoud of lage inhoudswaarde kunnen door Google worden gekozen om niet te indexeren Nieuwe sitebeoordelingsperiode (sandbox-effect): nieuwe websites hebben mogelijk een observatieperiode van enkele weken tot enkele maanden na Sitemap-indiening nodig voordat bulkindexering plaatsvindt Pagina's zijn noindex: pagina's retourneren noindex-metatags of X-Robots-Tag: noindex-antwoordheaders; Google zal ze actief uitsluiten Onvoldoende website-crawlbudget: lage site-autoriteit, trage serverrespons, slechte interne linkstructuur resulteren in lage crawlfrequentie toegewezen door Google-crawlers, wat meer tijd vereist Sitemap bevat veel laagwaardige URL's: als veel URL's in de Sitemap 404's, 5xx-fouten, dubbele inhoud of laagwaardige pagina's zijn, zal Google het vertrouwen in de hele Sitemap verminderen Domein bestraft: website heeft problemen die de Google-kwaliteitsrichtlijnen schenden (zoals spam, geschraapte inhoud, malware) waardoor indexering wordt geblokkeerd Pagina's zijn geïsoleerde pagina's: hoewel pagina's in de Sitemap staan, zijn er geen ingangen vanaf interne websitelinks; crawlers kunnen ze als onbelangrijk beschouwen en ze niet indexeren
Sitemap toont ontdekte URL's, maar werkelijke geïndexeerde aantal is erg laag
Dit is normaal: "Ontdekt" betekent alleen dat Google de Sitemap heeft bezocht en de URL's heeft gezien, niet dat ze allemaal worden geïndexeerd; indexeringssnelheid is afhankelijk van paginakwaliteit Problemen met dubbele inhoud: meerdere URL's met zeer vergelijkbare inhoud (zoals dezelfde pagina met verschillende parameters, afdrukversies, paginering) zorgen ervoor dat Google één canonieke versie kiest om te indexeren Canonieke tag die naar andere pagina's verwijst: pagina heeft <link rel="canonical" href="andere URL"> ingesteld; Google indexeert het adres waarnaar canonieke verwijst Pagina-inhoud is te dun: te weinig woorden, geen wezenlijke waarde, geschraapte inhoud — Google vindt het niet de moeite waard om te indexeren Pagina-laadsnelheid is te laag: serverreactietime-out, pagina's die te langzaam laden; crawlers verlagen de crawlprioriteit na meerdere mislukte ophaalacties HTTPS-certificaatproblemen: ongeldige SSL-certificaten, gemengde-inhoudsfouten, naast elkaar bestaande HTTP/HTTPS-versies die canonieke problemen veroorzaken Problemen met mobiele aanpassing: slechte mobielvriendelijkheid, fouten in mobiele aanpassing beïnvloeden indexering in een mobile-first indexeringsomgeving
Bing kan Sitemap normaal crawlen, maar Google crawlt helemaal niet
Google Search Console-verificatieproblemen: bevestig dat domeineigendomsverificatie geldig is en het geverifieerde domein (www/non-www, http/https) overeenkomt met de werkelijke toegangsversie Serverfirewall of CDN blokkeert Googlebot: controleer servertoegangslogboeken om te zien of Googlebot-verzoeken (user-agent met Googlebot) worden geblokkeerd of 403 retourneren DNS-resolutieproblemen: Google's DNS-resolutie naar andere IP-adressen dan Bing; zorg ervoor dat alle regio's correct naar uw server kunnen resolven robots.txt heeft speciale beperkingen voor Googlebot: controleer of er speciale Disallow-regels zijn onder User-agent: Googlebot Website had eerdere cheatgeschiedenis die door Google is bestraft: domeinen die handmatige acties hebben ontvangen, moeten eerst een heroverweging aanvragen Sitemap-URL bevat inhoud die Google als onveilig beschouwt: zoals domeinen die zijn gemarkeerd voor malware of phishing-inhoud CDN WAF-regels veroorzaken valse positieven: sommige beveiligingsregels kunnen Googlebot-crawlergedrag verkeerd identificeren; controleer CDN-beveiligingslogboeken
Gegenereerde Sitemap test lokaal prima, maar toegang ertoe na serverupload retourneert een 404-fout
Onjuist bestandspad: sitemap.xml is niet geüpload naar de juiste map; bevestig dat het is geüpload naar de locatie die overeenkomt met de URL die u in robots.txt hebt gedeclareerd en bij zoekmachines hebt ingediend Problemen met bestandsnaam hoofdlettergevoeligheid: Linux/Unix-servers zijn hoofdlettergevoelig; Sitemap.xml en sitemap.xml zijn verschillende bestanden; zorg ervoor dat de bestandsnaam volledig in kleine letters is Nginx/Apache-configuratie blokkeert toegang tot xml-bestanden: controleer de serverconfiguratie op locatie-regels die toegang tot .xml-bestandsextensies weigeren of onjuiste try_files-regels Bestandsrechtenproblemen: onjuiste bestandsrechten op de server (zoals 600-rechten) waarbij de webservergebruiker geen leesrechten heeft; meestal zijn 644-rechten vereist, mappen hebben 755-rechten nodig CDN heeft oude 404-reactie in cache: nieuw geüploade bestanden hebben mogelijk nog steeds de vorige 404 in CDN-cache; u moet de CDN-cache vernieuwen of wachten tot CDN automatisch de bron vernieuwt Conflicten met permalinkregels in WordPress of een ander CMS: CMS-herschrijfregels onderscheppen sitemap.xml; u moet uitsluitingsregels configureren zodat de server direct toegang heeft tot statische bestanden Server heeft hotlinkbeveiliging of toegangscontrole geconfigureerd: referer-controles, IP-whitelists of andere regels in .htaccess- of Nginx-configuratie kunnen crawlertoegang blokkeren
Woordenlijst
- Sitemap
- Een XML-protocolstandaardbestand dat zoekmachines informeert over alle crawlbare pagina's op een website, met een volledige URL-lijst en metadata voor elke URL. Helpt crawlers zoals Googlebot en Bingbot website-inhoud intelligenter en efficiënter te ontdekken, begrijpen en crawlen. Onderhouden door de sitemaps.org-organisatie als een uniform open protocolstandaard (huidige versie 0.9).
- urlset
- Het root-element van een standaard Sitemap XML-bestand, dat de juiste xmlns-naamruimtedeclaratie moet bevatten en alle <url> onderliggende elementitems moet nesten. De kernidentificatie van Sitemap-geldigheid — Sitemaps zonder een correcte urlset-structuur worden direct door zoekmachines geweigerd voor parsing.
- Sitemap Index
- Een sitemapindexbestand dat moet worden gebruikt wanneer het aantal URL's van een website meer dan 50.000 items bedraagt of een enkel Sitemap-bestand groter is dan 50MB. Het root-element is <sitemapindex>, gebruikt om meerdere sub-Sitemapbestandsadressen uniform te vermelden en te beheren, en is de standaardoplossing voor het splitsen van Sitemaps op grote websites.
- changefreq
- Een optioneel metadata-element in Sitemap dat wordt gebruikt om de geschatte updatefrequentie van pagina-inhoud te specificeren. Heeft zeven geldige waarden: always, hourly, daily, weekly, monthly, yearly en never. Verstrekt als referentie voor zoekmachinecrawlers om herhalingscrawlfrequentie te plannen; juiste instelling kan crawlbudgettoewijzing optimaliseren.
- priority
- Een optioneel metadata-element in Sitemap dat wordt gebruikt om de belangrijkheidsprioriteit van een URL ten opzichte van andere pagina's binnen de website te specificeren. Neemt een decimale waarde tussen 0.0 en 1.0 met een standaard van 0.5. priority beïnvloedt alleen de relatieve crawlprioriteit tussen pagina's binnen een site en beïnvloedt geen zoekresultaatranglijsten.
- lastmod
- Een optioneel metadata-element in Sitemap dat de datum en tijd van de laatste inhoudelijke wijziging van een pagina registreert. Het formaat moet voldoen aan de W3C Datetime-specificatie. Het is het belangrijkste van de drie optionele metadatavelden voor zoekmachines, omdat het direct aangeeft of een pagina nieuwe inhoud heeft die opnieuw moet worden gecrawld.
- loc
- Een verplicht onderliggend element onder <url>-elementen dat wordt gebruikt om het volledige absolute URL-adres van een pagina te specificeren. Moet beginnen met het http:// of https:// protocol, de volledige domeinnaam bevatten, totale URL-lengte mag niet meer dan 2048 tekens zijn, en relatieve paden zijn niet toegestaan.
- XML-naamruimte (xmlns)
- Een XML-naamruimteattribuut dat moet worden gedeclareerd op het urlset-root-element. De attribuutwaarde moet exact overeenkomen met http://www.sitemaps.org/schemas/sitemap/0.9 om de protocolversie te identificeren die door de Sitemap wordt gebruikt. Ontbrekende of onjuist geschreven naamruimten veroorzaken Sitemap-parseerfouten.
- W3C Datetime
- Datum- en tijdweergaveformaat gespecificeerd door W3C (World Wide Web Consortium). Het lastmod-veld in Sitemaps moet aan dit formaat voldoen. Het vereenvoudigde datumformaat YYYY-MM-DD wordt vaak gebruikt (beste compatibiliteit), en het volledige datum-tijdformaat met uren, minuten, seconden en tijdzone-informatie wordt ook ondersteund.
- XML Entiteit Escaping
- In XML-syntaxis moeten speciale tekens worden ge-escaped naar bijbehorende entiteitsverwijzingen voor correcte parsing: & escaped naar &, < escaped naar <, > escaped naar >, " escaped naar ", ' escaped naar '. URL's die deze tekens bevatten, moeten worden ge-escaped, anders treden er XML-parseerfouten op.
- Google Search Console (GSC)
- Google's officiële webmasterplatformtool die wordt gebruikt voor het indienen van Sitemaps, het bekijken van website-indexstatus, analyse van zoekverkeersgegevens, crawlfoutrapporten, beveiligingsprobleemmeldingen, handmatige actiestrafmeldingen, enz. Een essentieel hulpmiddel voor Google-zoekmachineoptimalisatie (SEO).
- Bing Webmaster Tools
- De officiële webmasterplatform van Microsoft Bing-zoekmachine met functionaliteit vergelijkbaar met Google Search Console. Ondersteunt Sitemap-indiening, indexdekkingsstatistieken, SEO-diagnoseanalyse, trefwoordonderzoek, backlinkquery's, enz., voor zoekverkeer van zowel Bing- als Yahoo-zoekmachines.
- robots.txt
- Een tekstbestand dat in de hoofdmap van een website wordt geplaatst en richtlijnen zoals User-agent, Disallow en Allow gebruikt om zoekmachinecrawlers te vertellen welke paden mogen worden gecrawld en welke paden verboden zijn. Het kan ook Sitemap-bestandslocaties in het bestand declareren voor automatische ontdekking door crawlers.
- Crawler (Spider/Bot)
- Geautomatiseerde programma's ontwikkeld door zoekmachines om webinhoud op te halen, zoals Googlebot (Google-crawler), Bingbot (Bing-crawler) en Baiduspider (Baidu-crawler). Ze ontdekken nieuwe pagina's door paginalinks te volgen en Sitemap-bestanden te lezen, paginainhoud te downloaden en op te slaan in zoekmachine-indexdatabases.
- Crawlbudget
- De totale hoeveelheid crawlresource die door zoekmachines aan een website wordt toegewezen binnen een bepaalde periode, bepaald door meerdere factoren, waaronder domeinautoriteit, serverresponssnelheid, paginainhoudskwaliteit en historische crawleffectiviteit. Correcte Sitemap-configuratie kan helpen de efficiëntie van crawlbudgetgebruik te optimaliseren.
- UTF-8-codering
- De tekencodering die verplicht is voor Sitemap XML-bestanden. UTF-8 ondersteunt alle Unicode-tekens, inclusief Nederlandse tekens, gespecificeerd in de XML-verklaring via het encoding="UTF-8"-attribuut. Het gebruik van andere coderingen kan karaktervertekening en parseerfouten veroorzaken in meertalige URL's.
- gzip-compressie
- Het Sitemap-protocol ondersteunt compressietransfer met het gzip-algoritme (bestandsextensie .xml.gz), waardoor de Sitemap-bestandsgrootte met 70%-80% kan worden verkleind, wat serverbandbreedte en crawlerdownloadtijd aanzienlijk bespaart. Grote zoekmachines kunnen gzip-gecomprimeerde Sitemap-bestanden automatisch decomprimeren en verwerken; gecomprimeerde bestanden moeten nog steeds voldoen aan de 50MB-groottebeperking.
- Yoast SEO
- Een veelgebruikte SEO-plug-in op CMS-platforms zoals WordPress en Shopify die automatisch Sitemaps, meta-tags, broodkruimelnavigatie, XML-sitemaps, RSS-optimalisatie, social media-metadata en andere SEO-gerelateerde functies kan genereren. Een veelgebruikte SEO-oplossing voor op inhoud gerichte websites.
- Indexdekking
- Een van de kernrapporten in Google Search Console, met gedetailleerde aantallen en redenen van pagina's die zijn geïndexeerd, uitgesloten, met fouten en met waarschuwingen op een website. Kan worden gebruikt om Sitemap-indieningseffectiviteit te verifiëren en paginaindexeringsproblemen te diagnosticeren.
- URL-codering (Percentcodering)
- Ook wel percentcodering genoemd, een coderingsmethode die wordt gebruikt om niet-ASCII-tekens (zoals Nederlandse tekens en speciale symbolen) in URL's weer te geven. Speciale tekens worden gecodeerd in de vorm %XX%XX%XX. Meertalige URL's in Sitemaps moeten correct worden gecodeerd om te worden geparseerd.
changefreq Updatefrequentie Scenario Referentietabel
| changefreq-waarde | Updatefrequentie | Typische toepasselijke paginatypes | Opmerkingen |
|---|---|---|---|
always | Kan bij elk bezoek veranderen | Realtime gegevenspagina's, zoekingangen, dynamische aggregatiepagina's | Betekent niet dat crawlers elke keer komen, geeft alleen extreem hoge wijzigingsfrequentie aan; misbruik niet — gewone pagina's mogen niet op always worden ingesteld |
hourly | Wordt elk uur bijgewerkt | Nieuwshomepages, social media-feeds, realtime prijspagina's | Geschikt voor pagina's met elk uur nieuwe inhoud; niet-hoogfrequente sites mogen niet op hourly worden ingesteld |
daily | Wordt dagelijks bijgewerkt | Websitehomepage, bloglijstpagina's, nieuwskanaalpagina's, productcategoripagina's | Een van de meest gebruikte waarden; geschikt voor de meeste sitehomepages en sectiepagina's |
weekly | Wordt wekelijks bijgewerkt | Gewone artikeldetailpagina's, productdetailpagina's, blogberichtpagina's | Geschikt voor inhoudspagina's op de meeste op inhoud gerichte websites |
monthly | Wordt maandelijks bijgewerkt | Categorimappagina's, archiefpagina's, FAQ-pagina's, gebruikershandleidingpagina's | Hulppagina's met onregelmatige inhoudsupdates maar incidentele aanpassingen |
yearly | Wordt jaarlijks bijgewerkt | Bedrijfsintroductiepagina's, contactpagina's, servicevoorwaarden, privacybeleid | Statische informatiepagina's die bijna nooit veranderen |
never | Wordt nooit bijgewerkt | Historische artikelarchieven, verlopen evenementenpagina's, gearchiveerde oude inhoud | Stel pagina's die niet meer worden gewijzigd in op never; vergeet ze onmiddellijk terug te zetten als er updates zijn |
priority Prioriteitsinstelling Referentietabel
| priority-waarde | Prioriteitsniveau | Toepasselijke paginatypes | Aanbevolen pagina-aantal verhouding |
|---|---|---|---|
1.0 | Hoogste | Websitehomepage, kernbestemmingspagina's, belangrijkste kanaalingangen | Slechts 1-3 pagina's over de hele site |
0.8-0.9 | Zeer hoog | Hoofdsectiepagina's, populaire categoripagina's, kernproductpagina's, belangrijke speciale onderwerpen | Ongeveer 5-10% van alle pagina's |
0.6-0.7 | Hoog | Secundaire sectiepagina's, subcategoripagina's, populaire artikelen, belangrijke productdetails | Ongeveer 10-20% van alle pagina's |
0.4-0.5 | Normaal | Gewone artikeldetailpagina's, algemene productpagina's, standaard inhoudspagina's | Ongeveer 40-60% van alle pagina's (standaardwaarde) |
0.2-0.3 | Laag | Tagpagina's, archiefpaginering, oude artikelarchieven, hulppagina's | Ongeveer 15-25% van alle pagina's |
0.0-0.1 | Laagste | Laagwaardige pagina's, dubbele inhoudspagina's, pagina's die niet prioriteit krijgen om te crawlen | Binnen ongeveer 5% van alle pagina's; 0 betekent niet noindex |
Sitemap Protocolspecificatie Limiettabel
| Limietitem | Bovengrens | Beschrijving | Overschrijdingsoplossing |
|---|---|---|---|
| URL's per enkele Sitemap | 50.000 items | Vaste vereiste van het sitemap.org 0.9-protocol | Gebruik Sitemap Index om te splitsen in meerdere sub-Sitemaps |
| Niet-gecomprimeerde grootte van enkel Sitemap-bestand | 50MB (52428800 bytes) | Ruwe bestandsgrootte inclusief alle tags en witruimte | Gebruik gzip-compressie, splits Sitemaps, minimaliseer opmerkingen |
| Sub-Sitemaps per Sitemap Index | 50.000 items | URL-itemlimiet voor het indexbestand zelf | Theoretisch ondersteunt het 2,5 miljard URL's; onnodig voor de meeste sites |
| Lengte van enkele URL | 2.048 tekens | Inclusief protocol, domein, pad en alle queryparameters | Te lange URL's vereisen parametervereenvoudiging of URL-herschrijving |
| Door Sitemap ondersteunde codering | UTF-8 | Verplicht door protocol; andere coderingen kunnen parseerfouten veroorzaken | Zorg ervoor dat bestanden worden opgeslagen met UTF-8-codering |
| Door Sitemap ondersteunde protocollen | http:// of https:// | URL's moeten een volledig protocolvoorvoegsel bevatten | ftp:// en andere protocollen worden niet ondersteund |
| Crawlerresponstijd na indiening | Enkele uren tot enkele dagen | Afhankelijk van site-autoriteit en Sitemap-complexiteit | Niet nodig om opnieuw in te dienen; wacht geduldig op verwerking |
| gzip-gecomprimeerde bestandsgrootte | 50MB | Gecomprimeerde bestanden mogen ook de limiet van 50MB niet overschrijden | Overschrijding na compressie vereist nog steeds Sitemap-splitsing |
- Authenticatie Header Generator
- Cache-Control Parser
- Content-Disposition Parser
- CORS Header Generator
- CORS Inspecteur
- CSP Generator
- cURL naar Code Converter
- Globale DNS Propagatie Controle
- DNS-lookup
- Forwarded Header Parser
- Hreflang Tag Generator
- HSTS Analyzer
- HTTP Cookie Parser
- HTTP Headers Checker
- HTTP Request Tester
- HTTP Status Codes Opzoeken
- IP Opzoeken
- IPv4 Converter
- IPv4 Range Expander
- IPv6 Toolbox
- Link Header Parser
- MX Lookup
- Port Checker
- URL Parameter Builder
- Rate Limit Header Parser
- Redirect Checker
- Robots.txt Generator
- Robots.txt Checker
- Security Headers Checker
- Security.txt Generator
- Set-Cookie-Parser
- Site Network Audit
- Sitemap Generator
- Sitemap Inspector
- SSL Certificaat Controle
- Subnet Rekenmachine
- URL Parser
- User-Agent parser
- UTM Builder
- WebSocket Tester
- What Is My IP?
- WHOIS Opzoeken