Sitemap जनरेटर
sitemap.xml जेनरेटर
URL सूची दर्ज करें, changefreq, priority और lastmod विश्व स्तर पर सेट करें, एक क्लिक में sitemap.org-संगत XML साइटमैप बनाएं।
sitemap.org 0.9 ओपन प्रोटोकॉल मानक के अनुरूप Sitemap XML वेबसाइट मानचित्र फ़ाइलें ऑनलाइन जनरेट करें, changefreq सात अपडेट आवृत्तियों, priority 0.0-1.0 सापेक्ष प्राथमिकता, lastmod दिनांक चयनकर्ता पूर्ण कॉन्फ़िगरेशन का समर्थन करता है, स्वचालित XML इकाई एस्केपिंग, अमान्य URL रीयल-टाइम पहचान, संरचित XML रीयल-टाइम पूर्वावलोकन, एक-क्लिक डाउनलोड और कॉपी कार्यक्षमता के साथ, Google/Bing प्रमुख खोज इंजनों को वेबसाइट के सभी महत्वपूर्ण पेजों को तेज़ी से खोजने और कुशलतापूर्वक इंडेक्स करने में मदद करता है।
संबंधित सुझाव
उपयोग के मामले
- नई वेबसाइट लॉन्च होने के बाद मुख्य पेजों का Sitemap बैच में जनरेट करें, खोज इंजनों को तेज़ी से खोजने और इंडेक्स करने में तेजी लाने के लिए Google Search Console और Bing Webmaster Tools पर सबमिट करें
- वेबसाइट सेक्शन रीडिज़ाइन या URL संरचना समायोजन के बाद साइट मानचित्र को फिर से जनरेट करें, SEO प्रदर्शन को प्रभावित करने वाले मृत लिंक अवशेषों से बचने के लिए खोज इंजन इंडेक्स अपडेट करें
- ई-कॉमर्स वेबसाइटें उत्पाद सूची URL को बैच में आयात करें, उत्पाद श्रेणी, लॉन्च समय के अनुसार अलग-अलग changefreq और priority मान सेट करें
- बड़े पोर्टल या समाचार साइटें जब 50000 से अधिक URL हों, चैनल के अनुसार कई Sitemap जनरेट करें और Sitemap Index फ़ाइल बनाएं
- ब्लॉग वेबसाइटें लेख पेज, टैग पेज, श्रेणी पेज, आर्काइव पेज के लिए क्रमशः उचित अपडेट आवृत्ति और प्राथमिकता पैरामीटर कॉन्फ़िगर करें
- कॉर्पोरेट वेबसाइटें उत्पाद पेज, समाचार पेज, अबाउट पेज, संपर्क पेज जैसे विभिन्न प्रकार के URL को व्यवस्थित करें, अंतर lastmod और priority सेट करें
- वेबसाइट माइग्रेशन पूरा होने के बाद (HTTP से HTTPS अपग्रेड, डोमेन परिवर्तन) Sitemap को फिर से जनरेट करें और सबमिट करें, क्रॉलर को नए पते को तेज़ी से क्रॉल करने के लिए मार्गदर्शन करें
- Yoast SEO जैसे प्लगइन द्वारा जनरेट किए गए Sitemap की मैन्युअल पूर्ति करें, प्लगइन द्वारा कवर नहीं किए गए विशेष पेज URL जोड़ें
- SEO निदान और ऑप्टिमाइज़ेशन के बाद Sitemap को फिर से जनरेट करें, सुनिश्चित करें कि महत्वपूर्ण पेजों की priority सेटिंग उचित है, उच्च-मूल्य वाले पेजों की क्रॉल प्रायोरिटी बढ़ाएं
- robots.txt में Sitemap स्थान घोषित करने से पहले, XML स्वरूप की शुद्धता को सत्यापित करने के लिए इस टूल का उपयोग करें, क्रॉलर पार्सिंग विफलता से बचें
उपयोग कैसे करें
- URL इनपुट क्षेत्र में इंडेक्स किए जाने वाले पेज पते की सूची पेस्ट करें, प्रति पंक्ति एक पूर्ण URL (http:// या https:// प्रोटोकॉल हेडर शामिल होना चाहिए)
- changefreq ड्रॉपडाउन मेनू में पेज अपडेट आवृत्ति चुनें: होमपेज के लिए daily या hourly चुनें, लेख पेज के लिए weekly, स्टैटिक पेज के लिए yearly या monthly
- priority स्लाइडर खींचें या प्राथमिकता सेट करने के लिए 0.0-1.0 के बीच मान दर्ज करें: मुख्य होमपेज को 1.0, महत्वपूर्ण सेक्शन पेज को 0.8, सामान्य लेख पेज को 0.5, आर्काइव पेज को 0.3 पर सेट करें
- lastmod दिनांक चयनकर्ता पर क्लिक करें, वेबसाइट सामग्री की अंतिम संशोधन तिथि चुनें, या lastmod फ़ील्ड को शामिल न करने के लिए खाली छोड़ दें
- दाईं ओर रीयल-टाइम पूर्वावलोकन क्षेत्र देखें, जनरेट की गई XML संरचना सही है या नहीं जांचें, अमान्य URL को लाल रंग में चिह्नित किया जाएगा सुधार के लिए
- पुष्टि करने के बाद फ़ाइल सहेजने के लिए "sitemap.xml डाउनलोड करें" बटन पर क्लिक करें, या XML सामग्री को क्लिपबोर्ड पर कॉपी करने के लिए "कॉपी" बटन पर क्लिक करें
- sitemap.xml को वेबसाइट रूट निर्देशिका में अपलोड करें, robots.txt में Sitemap घोषणा जोड़ें, या सीधे Google Search Console/Bing Webmaster पर सबमिट करें
विशेषताएं
- बैच URL इनपुट समर्थन: प्रति पंक्ति एक URL, रिक्त पंक्तियों और डुप्लिकेट लिंक को स्वचालित रूप से फ़िल्टर करता है, बड़ी मात्रा में पेज पते को तेज़ी से प्रोसेस करता है
- XML इकाई स्वचालित एस्केपिंग: URL में &, <, >, ", ' जैसे विशेष वर्णों को स्वचालित रूप से &, <, >, ", ' में एस्केप किया जाता है, जिससे XML पार्सिंग त्रुटियाँ पूरी तरह से बची जाती हैं
- 7 changefreq अपडेट आवृत्ति विकल्प: always, hourly, daily, weekly, monthly, yearly, never, सभी पेज प्रकार के परिदृश्यों को कवर करते हैं
- priority प्राथमिकता सटीक सेटिंग: 0.0 से 1.0 के बीच किसी भी मान का समर्थन करता है, दशमलव के बाद एक अंक की सटीकता का समर्थन करता है, पेज की महत्वपूर्णता को अलग करता है
- lastmod अंतिम संशोधन समय दिनांक चयनकर्ता: विज़ुअल कैलेंडर चयनकर्ता, स्वचालित रूप से W3C Datetime मानक फ़ॉर्मेट (YYYY-MM-DD) में फ़ॉर्मेट करता है
- अमान्य URL रीयल-टाइम पहचान: स्वरूप त्रुटियों वाले URL को स्वचालित रूप से पहचानता है (प्रोटोकॉल गुम होना, अवैध वर्ण आदि), सुधार के लिए समस्या पंक्ति संख्या को चिह्नित करता है
- रीयल-टाइम पूर्वावलोकन जनरेशन: URL सूची या कॉन्फ़िगरेशन पैरामीटर संशोधित करने के बाद XML सामग्री तुरंत अपडेट होती है, जनरेट बटन पर मैन्युअल रूप से क्लिक करने की आवश्यकता नहीं है
- एक-क्लिक sitemap.xml डाउनलोड: जनरेट किए गए परिणाम सीधे मानक XML फ़ाइल के रूप में डाउनलोड होते हैं, सहेजने के बाद तुरंत वेबसाइट सर्वर पर अपलोड किए जा सकते हैं
- URL सीमा चेतावनी: जब इनपुट URL 50000 तक पहुँचते हैं तो स्वचालित रूप से Sitemap Index विभाजन योजना का उपयोग करने का संकेत देता है
- क्लिपबोर्ड पर कॉपी: पूर्ण XML सामग्री को एक क्लिक में क्लिपबोर्ड पर कॉपी करता है, जिससे सर्वर फ़ाइल या ऑनलाइन सबमिशन में सीधे पेस्ट करना सुविधाजनक होता है
- बाइट आकार सांख्यिकी: जनरेट की गई Sitemap XML फ़ाइल के बाइट आकार को रीयल-टाइम में प्रदर्शित करता है, यह मूल्यांकन करता है कि फ़ाइल आकार खोज इंजन सीमाओं का पालन करता है या नहीं
- मानक urlset रूट तत्व आउटपुट: http://www.sitemaps.org/schemas/sitemap/0.9 प्रोटोकॉल विनिर्देश का सख्ती से पालन करता है, सही xmlns नेमस्पेस घोषणा शामिल है
- UTF-8 एन्कोडिंग घोषणा: स्वचालित रूप से XML एन्कोडिंग घोषणा जोड़ता है, जिससे चीनी जैसी बहुभाषी URL का सही पार्सिंग बिना गड़बड़ वर्णों के सुनिश्चित होता है
सामान्य प्रश्न
क्या Sitemap सबमिट करना अनिवार्य है? क्या सबमिट न करने पर वेबसाइट इंडेक्स नहीं होगी?
Sitemap सबमिट न करने पर भी वेबसाइट इंडेक्स हो सकती है—खोज इंजन अन्य वेबसाइटों के बाहरी लिंक, आंतरिक लिंक ट्रैकिंग के माध्यम से आपके पेज खोज सकते हैं। लेकिन Sitemap सबमिट करने से खोज की गति काफी बढ़ सकती है, विशेष रूप से नई साइटों, बड़ी वेबसाइटों, अपूर्ण आंतरिक लिंक वाली वेबसाइटों के लिए। Google आधिकारिक तौर पर सभी वेबसाइटों को Sitemap सबमिट करने की सिफारिश करता है, यह बहुत कम लागत वाला और उच्च लाभ वाला SEO बुनियादी कार्य है।
क्या Sitemap में URL पूर्ण पथ होना चाहिए? क्या सापेक्ष पथ लिख सकते हैं?
पूर्ण पूर्ण URL होना चाहिए, जिसमें प्रोटोकॉल हेडर (http:// या https://) और पूर्ण डोमेन शामिल हो, सापेक्ष पथ (जैसे /page1.html) या प्रोटोकॉल छोड़कर लिखने की अनुमति नहीं है। खोज इंजन Sitemap पार्स करते समय सही क्रॉल करने के लिए पूर्ण URL की आवश्यकता होती है, सापेक्ष पथ पार्सिंग त्रुटि का कारण बनेंगे।
क्या changefreq और priority सेटिंग वास्तव में उपयोगी हैं? क्या खोज इंजन इनका पालन करेंगे?
ये दोनों फ़ील्ड "सुझाव" हैं "आदेश" नहीं, खोज इंजन 100% पालन नहीं कर सकते हैं, लेकिन सटीक सेटिंग का अभी भी संदर्भ मूल्य है। तुलनात्मक रूप से lastmod (अंतिम संशोधन समय) तीन फ़ील्ड में से वह है जिसे खोज इंजन सबसे अधिक महत्व देते हैं, क्योंकि यह सीधे क्रॉलर को बता सकता है कि पेज पर नई सामग्री है या नहीं। झूठ बोलकर सभी पेजों को उच्चतम प्राथमिकता या always पर सेट न करें, इससे खोज इंजन इन मेटाडेटा पर भरोसा नहीं करेंगे।
क्या Sitemap फ़ाइल को वेबसाइट रूट निर्देशिका में रखना अनिवार्य है?
जरूरी नहीं, Sitemap को वेबसाइट के किसी भी पथ पर रखा जा सकता है, जब तक URL सामान्य रूप से एक्सेस किया जा सकता है। लेकिन robots.txt को रूट निर्देशिका में रखना अनिवार्य है। यदि आप Sitemap Index का उपयोग करके कई Sitemap विभाजित करते हैं, तो उप-Sitemap के पथ पर कोई प्रतिबंध नहीं है। हालांकि आदतन रूट निर्देशिका में रखना प्रबंधन करने में सबसे सुविधाजनक है, क्रॉलर को खोजने में भी सुविधा होती है।
वेबसाइट URL 50000 से कम हैं, लेकिन फ़ाइल आकार 50MB से अधिक है तो क्या करें?
Sitemap को विभाजित करने की आवश्यकता है। 50000 और 50MB दो समानांतर प्रतिबंध हैं, किसी भी एक सीमा पार करने की स्थिति में विभाजन करना आवश्यक है। आप सामग्री प्रकार के अनुसार विभाजित कर सकते हैं, या Sitemap को सरल बना सकते हैं (जैसे अनावश्यक रिक्त स्थान, इंडेंटेशन हटाना, gzip संपीड़न का उपयोग करना), लेकिन यदि संपीड़न के बाद भी 50MB से अधिक है तो विभाजन करना अनिवार्य है।
क्या Sitemap में noindex पेज या robots.txt द्वारा निषिद्ध URL शामिल कर सकते हैं?
अनुशंसित नहीं। Sitemap में केवल वे पेज शामिल होने चाहिए जिन्हें आप खोज इंजन द्वारा क्रॉल और इंडेक्स करना चाहते हैं। noindex पेज, Disallow निषिद्ध पेज, लॉगिन के बाद ही एक्सेस किए जा सकने वाले पेज, 404 त्रुटि पेज Sitemap में नहीं होने चाहिए, इससे खोज इंजन का Sitemap के प्रति विश्वास कम होगा, साथ ही क्रॉल बजट भी बर्बाद होगा।
सामग्री अपडेट करने के बाद क्या Sitemap को फिर से सबमिट करने की आवश्यकता है? Sitemap को कितनी बार अपडेट करना उचित है?
जब तक Sitemap फ़ाइल URL समान रहता है, खोज इंजन नियमित रूप से फिर से क्रॉल करेंगे, हर बार सामग्री अपडेट होने पर मैन्युअल रूप से फिर से सबमिट करने की आवश्यकता नहीं है। अपडेट आवृत्ति आपकी वेबसाइट की सामग्री अपडेट आवृत्ति पर निर्भर करती है: समाचार प्रकार की वेबसाइटें प्रतिदिन या प्रति घंटा भी Sitemap अपडेट कर सकती हैं (स्वचालित जनरेशन), कॉर्पोरेट वेबसाइटें साप्ताहिक या मासिक रूप से एक बार अपडेट कर सकती हैं। सर्वर-साइड स्क्रिप्ट सेट करके Sitemap फ़ाइल को स्वचालित रूप से अपडेट किया जा सकता है।
Sitemap किन भाषाओं के URL का समर्थन करता है? क्या चीनी URL को एन्कोड करने की आवश्यकता है?
Sitemap किसी भी भाषा के URL का समर्थन करता है, लेकिन गैर-ASCII वर्णों (जैसे चीनी) वाले URL के लिए URL एन्कोडिंग (जिसे परसेंट-एन्कोडिंग भी कहा जाता है, percent-encoding) करनी चाहिए। उदाहरण के लिए "चीनी पेज" को %E4%B8%AD%E6%96%87%E9%A1%B5%E9%9D%A2 रूप में एन्कोड किया जाता है। अधिकांश ब्राउज़र और टूल स्वचालित रूप से प्रोसेस करते हैं, लेकिन आपको यह सुनिश्चित करना चाहिए कि जनरेट किए गए Sitemap में URL सही ढंग से एन्कोडेड हैं।
क्या एक साथ कई Sitemap सबमिट कर सकते हैं? जैसे लेख Sitemap और उत्पाद Sitemap दोनों एक साथ?
कर सकते हैं, दो तरीके हैं:①Sitemap Index अनुक्रमणिका फ़ाइल का उपयोग करके सभी उप-Sitemap को एकीकृत रूप से प्रबंधित करें, यह अनुशंसित तरीका है, केवल अनुक्रमणिका फ़ाइल URL सबमिट करने की आवश्यकता है;②वेबमास्टर प्लेटफ़ॉर्म पर प्रत्येक उप-Sitemap के URL को एक-एक करके सबमिट करें, यह तरीका भी काम करता है लेकिन प्रबंधन करना मुश्किल है। दोनों तरीके प्रभावी हैं, खोज इंजन दोनों को क्रॉल करेंगे।
Sitemap जनरेट करने के बाद क्या gzip संपीड़न करना चाहिए? संपीड़न के क्या लाभ हैं?
संपीड़न अनिवार्य नहीं है, लेकिन दृढ़ता से अनुशंसित है। gzip संपीड़न आमतौर पर Sitemap के आकार को 70%-80% कम कर सकता है, बैंडविड्थ और क्रॉलर क्रॉल समय बचाता है, विशेष रूप से बड़ी वेबसाइटों के लिए प्रभाव स्पष्ट है। खोज इंजन sitemap.xml.gz इस संपीड़ित फ़ॉर्मेट का पूरी तरह से समर्थन करते हैं, स्वचालित रूप से डीकंप्रेस करेंगे। जब तक संपीड़न के बाद 50MB से अधिक नहीं होता कोई समस्या नहीं है।
क्या HTTP और HTTPS दोनों संस्करणों की वेबसाइटों के लिए Sitemap सबमिट करने की आवश्यकता है?
आपको केवल वही संस्करण सबमिट करना चाहिए जिसे आप इंडेक्स करना चाहते हैं। यदि पूरी साइट HTTPS कर दी है और HTTP→HTTPS 301 रीडायरेक्शन कर दिया है, तो केवल HTTPS संस्करण का Sitemap सबमिट करें। HTTP और HTTPS दोनों संस्करण एक साथ सबमिट न करें, इससे डुप्लिकेट सामग्री समस्या होगी। इसी तरह, www और गैर-www के लिए भी पसंदीदा डोमेन निर्धारित करें, केवल पसंदीदा डोमेन का Sitemap सबमिट करें।
WordPress पर Yoast SEO से Sitemap जनरेट किया है, क्या अभी भी इस टूल का उपयोग करने की आवश्यकता है?
Yoast SEO अधिकांश पेजों का Sitemap स्वचालित रूप से जनरेट कर सकता है, लेकिन कुछ पेज छूट सकते हैं—जैसे आप मैन्युअल रूप से बनाए गए सिंगल पेज, कस्टम पोस्ट प्रकार ठीक से कॉन्फ़िगर नहीं किए गए, विशेष लैंडिंग पेज, बाहरी रूप से आयात किए गए पेज आदि। आप इस टूल का उपयोग करके Yoast द्वारा कवर नहीं किए गए इन URL की पूर्ति कर सकते हैं, अलग पूरक Sitemap जनरेट कर सकते हैं, या Yoast द्वारा जनरेट किए गए Sitemap की पूर्णता और शुद्धता की तुलना करके जांच कर सकते हैं।
क्या Sitemap में URL का क्रम महत्वपूर्ण है? क्या महत्वपूर्ण पेजों को सामने रखने से कोई फायदा है?
Sitemap प्रोटोकॉल में URL क्रम का कोई आधिकारिक भारांक नहीं है, खोज इंजन URL सामने होने के कारण प्राथमिकता से क्रॉल नहीं करेंगे। लेकिन कुछ SEO पेशेवरों ने मामूली क्रम वरीयता प्रभाव देखा है, इसलिए महत्वपूर्ण URL को सामने रखने में कोई बुराई नहीं है, लेकिन इससे स्पष्ट प्रभाव की उम्मीद न करें, प्राथमिकता को सही ढंग से चिह्नित करने के लिए priority फ़ील्ड का उपयोग करना चाहिए।
क्या पेजिनेशन पेज (जैसे /list?page=2, /page/3) को Sitemap में डालना चाहिए?
यह पेजिनेशन सामग्री के मूल्य पर निर्भर करता है। यदि पेजिनेशन "और देखें" प्रकृति की डुप्लिकेट सूची है (जैसे लेख सूची का दूसरा पेज, तीसरा पेज), तो आमतौर पर Sitemap में डालने की अनुशंसा नहीं की जाती है, क्योंकि ये पेज सामग्री डुप्लिकेट और कम मूल्य वाली होती हैं, फोकस सूची होमपेज और विशिष्ट लेख पेजों पर होना चाहिए। लेकिन यदि पेजिनेशन अद्वितीय सामग्री है (जैसे श्रेणी ब्राउज़िंग, पेजिनेशन का स्वतंत्र मूल्य है) तो शामिल करने पर विचार किया जा सकता है, कम priority सेट करें।
Sitemap सही और प्रभावी है या नहीं कैसे सत्यापित करें?
कई सत्यापन विधियां हैं:①इस टूल से जनरेट करने के बाद पहले स्थानीय पर XML संरचना सही है या जांचें, टैग क्लोजर, नेमस्पेस, एस्केप वर्ण सामान्य हैं या नहीं जांचें;②sitemap-inspector टूल का उपयोग करके ऑनलाइन स्वरूप और URL एक्सेसयोग्यता सत्यापित करें, सभी URL के HTTP स्टेटस कोड बैच में जांचें;③अपलोड करने के बाद ब्राउज़र में सीधे Sitemap URL एक्सेस करके देखें कि क्या XML पार्सिंग त्रुटि के बिना सामान्य रूप से प्रदर्शित हो सकता है;④Google Search Console/Bing Webmaster Tools पर सबमिट करने के बाद स्थिति रिपोर्ट देखें, क्या कोई स्वरूप त्रुटि, URL एक्सेस नहीं किया जा सकता, सीमा पार आदि त्रुटि संकेत हैं, यह सबसे आधिकारिक सत्यापन विधि है;⑤XML सिंटैक्स शुद्धता जांचने के लिए ऑनलाइन XML सत्यापन टूल का भी उपयोग किया जा सकता है।
समस्या निवारण
जनरेट किया गया Sitemap XML ब्राउज़र में खोलने पर पार्सिंग त्रुटि दिखाता है, स्वरूप गलत होने का संकेत देता है
URL में &, <, > जैसे XML विशेष वर्ण हैं जो एस्केप नहीं किए गए: मैन्युअल पेस्ट करते समय टूल स्वचालित रूप से एस्केप करता है, लेकिन यदि आपने फ़ाइल को मैन्युअल रूप से संपादित किया है तो एस्केपिंग छूट सकती है XML घोषणा या urlset नेमस्पेस गलत लिखा है: पहली पंक्ति के xmlns मान की जांच करें कि क्या वह http://www.sitemaps.org/schemas/sitemap/0.9 से पूरी तरह मेल खाता है, कोई अतिरिक्त स्लैश नहीं है टैग सही ढंग से बंद नहीं हुए: सभी प्रारंभ टैग जैसे <url>, <loc> के संबंधित बंद टैग </url>, </loc> होने चाहिए, स्व-बंद टैग लेखन गलत न हो फ़ाइल एन्कोडिंग BOM के साथ UTF-8 नहीं है: Windows नोटपैड फ़ाइल को UTF-8 BOM या GBK एन्कोडिंग में सहेज सकता है जिससे पार्सिंग त्रुटि होती है, बिना BOM के UTF-8 में सहेजना आवश्यक है URL में अवैध वर्ण हैं: चीनी URL के लिए URL एन्कोडिंग (percent-encoding) करनी चाहिए, विशेष वर्ण एन्कोड नहीं किए जाने से XML पार्सिंग विफल हो जाएगी XML संस्करण घोषणा गलत है: पहली पंक्ति <?xml version="1.0" encoding="UTF-8"?> होनी चाहिए, 1.1 या अन्य संस्करण न लिखें टैग नेस्टिंग क्रम गलत है: उप-टैग पूरी तरह से माता-पिता टैग के भीतर होने चाहिए, क्रॉस नेस्टिंग नहीं होनी चाहिए, जैसे <url><loc></url></loc> यह क्रम गलत है
Google Search Console में Sitemap सबमिट करने के बाद "Sitemap पढ़ने में असमर्थ" या "स्वरूप त्रुटि" दिखाई देती है
Sitemap फ़ाइल URL एक्सेस नहीं किया जा सकता: ब्राउज़र में सीधे Sitemap URL एक्सेस करके जांचें कि क्या 200 स्टेटस कोड रिटर्न हो रहा है, कोई 403/404/500 त्रुटि नहीं है सर्वर ने गलत Content-Type रिटर्न किया: application/xml या text/xml रिटर्न होना चाहिए, यदि text/html रिटर्न होता है तो पहचान विफल हो जाएगी Sitemap में robots.txt द्वारा क्रॉल करने से निषिद्ध URL शामिल हैं: GSC को पता चलता है कि Sitemap में Disallow पथ है तो त्रुटि रिपोर्ट करेगा URL रीडायरेक्शन समस्या: Sitemap का URL यदि 301/302 से अन्य पते पर रीडायरेक्ट होता है तो त्रुटि होगी, सुनिश्चित करें कि URL सीधे एक्सेस किया जा सकता है रीडायरेक्ट नहीं HTTP/HTTPS या www/गैर-www मेल नहीं खाता: सबमिट किया गया Sitemap डोमेन GSC में सत्यापित डोमेन से मेल नहीं खाता (जैसे सत्यापित किया है www.example.com लेकिन Sitemap example.com का उपयोग करता है) Sitemap फ़ाइल बहुत बड़ी है 50MB सीमा से अधिक है या URL 50000 से अधिक हैं: GSC सीमा पार करने वाली फ़ाइलों को सीधे प्रोसेस करने से मना कर देगा XML इकाई के बजाय HTML इकाई का उपयोग किया गया है: स्पेस का HTML इकाई है XML इकाई नहीं, XML में इसका उपयोग नहीं किया जा सकता
Sitemap सबमिट किए काफी समय हो गया है, कई URL अभी भी Google द्वारा इंडेक्स नहीं हुए हैं
पेज गुणवत्ता समस्या: इंडेक्सिंग सबमिट करने से निश्चित रूप से नहीं मिलती, खराब मौलिकता वाली सामग्री, डुप्लिकेट सामग्री, कम मूल्य वाली सामग्री वाले पेज Google इंडेक्स नहीं करना चुन सकता है नई साइट समीक्षा अवधि (सैंडबॉक्स प्रभाव): नई वेबसाइटें Sitemap सबमिट करने के बाद बैच इंडेक्सिंग से पहले कुछ सप्ताह से लेकर कुछ महीनों की अवलोकन अवधि की आवश्यकता हो सकती है पेज noindex है: URL द्वारा रिटर्न किए गए पेज में noindex meta टैग या X-Robots-Tag: noindex रिस्पांस हेडर है, Google सक्रिय रूप से बहिष्कृत करेगा वेबसाइट क्रॉल बजट अपर्याप्त है: वेबसाइट प्राधिकरण कम है, सर्वर प्रतिक्रिया धीमी है, आंतरिक लिंक संरचना खराब है, Google क्रॉलर द्वारा आवंटित क्रॉल आवृत्ति कम है, अधिक समय चाहिए Sitemap में बड़ी संख्या में कम गुणवत्ता वाले URL शामिल हैं: यदि Sitemap में कई 404, 5xx त्रुटि, डुप्लिकेट सामग्री, कम मूल्य वाले पेज हैं, तो Google पूरे Sitemap के प्रति विश्वास कम कर देगा डोमेन को दंडित किया गया है: वेबसाइट में Google गुणवत्ता दिशानिर्देशों का उल्लंघन करने वाली समस्याएं हैं (जैसे धोखाधड़ी, स्पैम सामग्री, मैलवेयर) जिससे इंडेक्सिंग बाधित होती है पेज अलग-थलग पेज है: पेज भले ही Sitemap में हो, लेकिन वेबसाइट आंतरिक लिंक में कोई एंट्री नहीं है, क्रॉलर इसे महत्वहीन मान सकता है और इंडेक्स नहीं कर सकता
Sitemap में URL खोजे जाने का संकेत दिखाता है, लेकिन वास्तविक इंडेक्स संख्या बहुत कम है
यह सामान्य घटना है: "खोजा गया" केवल यह दर्शाता है कि Google ने Sitemap एक्सेस किया है और URL देखे हैं, इसका मतलब यह नहीं है कि सभी को इंडेक्स किया जाएगा, इंडेक्स दर पेज गुणवत्ता पर निर्भर करती है डुप्लिकेट सामग्री समस्या: कई URL की सामग्री अत्यधिक समान है (जैसे अलग-अलग पैरामीटर वाला समान पेज, प्रिंट संस्करण, पेजिनेशन), Google एक मानक संस्करण चुनकर इंडेक्स करेगा कैनोनिकल टैग (canonical) अन्य पेज की ओर इंगित करता है: पेज में <link rel="canonical" href="अन्य URL"> सेट है, Google canonical द्वारा इंगित पते को इंडेक्स करेगा पेज सामग्री बहुत पतली है: सामग्री शब्द संख्या बहुत कम है, कोई वास्तविक मूल्य नहीं, संग्रहीत सामग्री, Google इंडेक्स करने लायक नहीं मानता पेज लोड गति बहुत धीमी है: सर्वर प्रतिक्रिया टाइमआउट, पेज लोड बहुत धीमा, क्रॉलर क्रॉल विफल होने के कई बार बाद क्रॉल प्राथमिकता कम कर देगा HTTPS प्रमाणपत्र समस्या: SSL प्रमाणपत्र अमान्य, मिश्रित सामग्री त्रुटि, HTTP/HTTPS संस्करण एक साथ मौजूद होने से कैनोनिकल समस्या होती है मोबाइल अनुकूलन समस्या: मोबाइल मैत्री खराब है, मोबाइल अनुकूलन त्रुटि, मोबाइल-प्रथम इंडेक्सिंग वातावरण में इंडेक्सिंग प्रभावित होती है
Bing Sitemap को सामान्य रूप से क्रॉल कर सकता है लेकिन Google बिल्कुल भी क्रॉल नहीं करता
Google Search Console सत्यापन समस्या: डोमेन स्वामित्व सत्यापन मान्य है की पुष्टि करें, सत्यापित डोमेन (www/गैर-www, http/https) और वास्तविक एक्सेस संस्करण सुसंगत है सर्वर फ़ायरवॉल या CDN ने Googlebot को ब्लॉक किया है: सर्वर एक्सेस लॉग जांचें कि क्या Googlebot (user-agent में Googlebot शामिल) के अनुरोध ब्लॉक किए गए हैं या 403 रिटर्न हो रहा है DNS रिज़ॉल्यूशन समस्या: Google का DNS रिज़ॉल्यूशन Bing से अलग IP पते पर होता है, सुनिश्चित करें कि सभी क्षेत्रों में आपके सर्वर का सामान्य रिज़ॉल्यूशन हो सकता है robots.txt में Googlebot के लिए विशेष प्रतिबंध हैं: User-agent: Googlebot के अंतर्गत कोई विशेष Disallow नियम है या जांचें वेबसाइट का पहले धोखाधड़ी का इतिहास रहा है जिससे Google द्वारा प्राधिकरण कम किया गया है: मैन्युअल रूप से दंडित किए गए डोमेन को पहले पुनः समीक्षा के लिए आवेदन करना होगा Sitemap URL में Google द्वारा असुरक्षित मानी जाने वाली सामग्री शामिल है: जैसे मैलवेयर, फ़िशिंग सामग्री के रूप में चिह्नित डोमेन CDN के WAF नियम गलती से ब्लॉक करते हैं: कुछ सुरक्षा नियम Googlebot क्रॉलर व्यवहार को गलत तरीके से पहचान सकते हैं, CDN सुरक्षा लॉग जांचने की आवश्यकता है
जनरेट किया गया Sitemap स्थानीय परीक्षण में सामान्य है, सर्वर पर अपलोड करने के बाद एक्सेस करने पर 404 त्रुटि रिटर्न होती है
फ़ाइल पथ गलत है: sitemap.xml सही निर्देशिका में अपलोड नहीं हुआ, पुष्टि करें कि आप robots.txt और खोज इंजनों को सबमिट किए गए URL के अनुरूप स्थान पर अपलोड किया है फ़ाइल नाम केस समस्या: Linux/Unix सर्वर केस-संवेदी हैं, Sitemap.xml और sitemap.xml अलग-अलग फ़ाइलें हैं, सुनिश्चित करें कि फ़ाइल नाम सभी छोटे अक्षरों में है Nginx/Apache कॉन्फ़िगरेशन ने xml फ़ाइल एक्सेस को प्रतिबंधित किया है: सर्वर कॉन्फ़िगरेशन जांचें कि क्या कोई location नियम है जो .xml प्रत्यय फ़ाइल एक्सेस को अस्वीकार करता है या गलत try_files नियम रिटर्न करता है फ़ाइल अनुमति समस्या: सर्वर पर फ़ाइल अनुमति सेटिंग गलत है (जैसे 600 अनुमति), Web सर्वर उपयोगकर्ता के पास पढ़ने की अनुमति नहीं है, आमतौर पर 644 अनुमति की आवश्यकता होती है, निर्देशिका को 755 अनुमति चाहिए CDN ने पुराने 404 रिस्पांस को कैश किया है: अभी-अभी अपलोड की गई फ़ाइल CDN शायद अभी भी पिछले 404 को कैश किए हुए है, CDN कैश रीफ्रेश करने या CDN के स्वचालित रूप से स्रोत अपडेट होने की प्रतीक्षा करने की आवश्यकता है WordPress जैसे CMS के पर्मालिंक नियम संघर्ष: CMS के रीराइट नियम sitemap.xml को इंटरसेप्ट करते हैं, सर्वर को स्टैटिक फ़ाइल सीधे एक्सेस करने देने के लिए बहिष्करण नियम कॉन्फ़िगर करने की आवश्यकता है सर्वर ने एंटी-हॉटलिंकिंग या एक्सेस नियंत्रण कॉन्फ़िगर किया है: .htaccess या Nginx कॉन्फ़िगरेशन में referer जांच, IP श्वेतसूची जैसे नियम क्रॉलर एक्सेस को ब्लॉक कर सकते हैं
शब्दकोश
- Sitemap (साइट मानचित्र)
- खोज इंजनों को वेबसाइट पर सभी क्रॉल करने योग्य पेजों के बारे में सूचित करने वाली XML प्रोटोकॉल मानक फ़ाइल, जिसमें पूर्ण URL सूची और प्रत्येक URL की मेटाडेटा जानकारी शामिल होती है, Googlebot, Bingbot जैसे क्रॉलर को वेबसाइट सामग्री को अधिक बुद्धिमानी और कुशलता से खोजने, समझने और क्रॉल करने में मदद करती है, sitemaps.org संगठन द्वारा एकीकृत ओपन प्रोटोकॉल मानक (वर्तमान संस्करण 0.9) का रखरखाव किया जाता है।
- urlset
- मानक Sitemap XML फ़ाइल का रूट तत्व, जिसमें सही xmlns नेमस्पेस घोषणा शामिल होनी चाहिए, आंतरिक रूप से सभी <url> उप-तत्व प्रविष्टियां नेस्टेड होती हैं, Sitemap की वैधता का मुख्य पहचानकर्ता है, सही urlset संरचना के बिना Sitemap को खोज इंजन सीधे पार्स करने से मना कर देंगे।
- Sitemap Index
- साइट मानचित्र अनुक्रमणिका फ़ाइल, जब वेबसाइट की URL संख्या 50000 से अधिक हो या एकल Sitemap फ़ाइल का आकार 50MB से अधिक हो तो इसका उपयोग करना अनिवार्य है, रूट तत्व <sitemapindex> है, कई उप-Sitemap फ़ाइल पतों को एकीकृत रूप से सूचीबद्ध और प्रबंधित करने के लिए उपयोग किया जाता है, बड़ी वेबसाइटों के लिए Sitemap विभाजन का मानक समाधान है।
- changefreq
- Sitemap में वैकल्पिक मेटाडेटा तत्व, पेज सामग्री की लगभग अपडेट आवृत्ति निर्दिष्ट करने के लिए उपयोग किया जाता है, कुल always, hourly, daily, weekly, monthly, yearly, never सात मान्य मान हैं, खोज इंजन क्रॉलर को रेफरेंस के रूप में रिटर्न क्रॉल आवृत्ति व्यवस्थित करने के लिए, उचित सेटिंग क्रॉल बजट आवंटन को अनुकूलित कर सकती है।
- priority
- Sitemap में वैकल्पिक मेटाडेटा तत्व, वेबसाइट के अन्य पेजों के सापेक्ष该 URL की महत्वपूर्णता प्राथमिकता निर्दिष्ट करने के लिए उपयोग किया जाता है, मान सीमा 0.0 से 1.0 के बीच दशमलव है, डिफ़ॉल्ट मान 0.5 है, priority केवल आंतरिक पेजों की सापेक्ष क्रॉल प्राथमिकता को प्रभावित करती है, खोज परिणाम रैंकिंग को प्रभावित नहीं करती है।
- lastmod
- Sitemap में वैकल्पिक मेटाडेटा तत्व, पेज की अंतिम बार वास्तविक सामग्री संशोधन की तिथि और समय रिकॉर्ड करता है, फ़ॉर्मेट को W3C Datetime विनिर्देश का पालन करना चाहिए, तीन वैकल्पिक मेटाडेटा फ़ील्ड में से वह है जिसे खोज इंजन सबसे अधिक महत्व देते हैं, क्योंकि यह सीधे संकेत देता है कि पेज पर नई सामग्री है या नहीं जिसे फिर से क्रॉल करने की आवश्यकता है।
- loc
- <url> तत्व के अंतर्गत आवश्यक उप-तत्व, पेज का पूर्ण पूर्ण URL पता निर्दिष्ट करने के लिए उपयोग किया जाता है, http:// या https:// प्रोटोकॉल से शुरू होना चाहिए, पूर्ण डोमेन शामिल होना चाहिए, URL की कुल लंबाई 2048 वर्णों से अधिक नहीं होनी चाहिए, सापेक्ष पथ का उपयोग करने की अनुमति नहीं है।
- XML नेमस्पेस (xmlns)
- urlset रूट तत्व में घोषित किया जाने वाला अनिवार्य XML नेमस्पेस विशेषता, विशेषता मान को http://www.sitemaps.org/schemas/sitemap/0.9 से सटीक रूप से मेल खाना चाहिए, Sitemap द्वारा उपयोग किए जाने वाले प्रोटोकॉल संस्करण की पहचान करने के लिए उपयोग किया जाता है, नेमस्पेस गुम या गलत लिखा होने पर Sitemap पार्सिंग विफल हो जाएगी।
- W3C Datetime
- W3C (वर्ल्ड वाइड वेब कंसोर्टियम) द्वारा निर्धारित दिनांक और समय प्रतिनिधित्व फ़ॉर्मेट, Sitemap में lastmod फ़ील्ड को इस फ़ॉर्मेट का पालन करना चाहिए, सामान्यतः उपयोग किया जाने वाला YYYY-MM-DD सरलीकृत दिनांक फ़ॉर्मेट (सबसे अच्छी संगतता), घंटे, मिनट, सेकंड और टाइमज़ोन जानकारी वाला पूर्ण दिनांक समय फ़ॉर्मेट भी समर्थित है।
- XML इकाई एस्केपिंग
- XML सिंटैक्स में विशेष वर्णों को सही ढंग से पार्स करने के लिए संबंधित इकाई संदर्भ में एस्केप किया जाना चाहिए: & को & में, < को < में, > को > में, " को " में, ' को ' में, URL में ये वर्ण होने पर एस्केप करना अनिवार्य है, अन्यथा XML पार्सिंग त्रुटि होगी।
- Google Search Console (GSC)
- Google द्वारा प्रदान किया गया आधिकारिक वेबमास्टर प्लेटफ़ॉर्म टूल, Sitemap सबमिट करने, वेबसाइट इंडेक्स स्थिति देखने, खोज ट्रैफ़िक डेटा विश्लेषण, क्रॉल त्रुटि रिपोर्ट, सुरक्षा समस्या सूचना, मैन्युअल कार्रवाई दंड सूचना आदि के लिए उपयोग किया जाता है, Google खोज इंजन ऑप्टिमाइज़ेशन (SEO) के लिए आवश्यक टूल है।
- Bing Webmaster Tools
- माइक्रोसॉफ्ट Bing खोज इंजन का आधिकारिक वेबमास्टर प्लेटफ़ॉर्म, कार्यक्षमता Google Search Console के समान है, Sitemap सबमिशन, इंडेक्स कवरेज सांख्यिकी, SEO निदान विश्लेषण, कीवर्ड अनुसंधान, बैकलिंक क्वेरी आदि का समर्थन करता है, Bing और Yahoo दो प्रमुख खोज इंजनों के खोज ट्रैफ़िक को कवर करता है।
- robots.txt
- वेबसाइट रूट निर्देशिका में संग्रहीत शुद्ध पाठ फ़ाइल, User-agent, Disallow, Allow जैसे निर्देशों के माध्यम से खोज इंजन क्रॉलर को बताती है कि कौन से पथ क्रॉल करने की अनुमति है, कौन से पथ निषिद्ध हैं, साथ ही फ़ाइल में Sitemap फ़ाइल का स्थान भी घोषित किया जा सकता है ताकि क्रॉलर स्वचालित रूप से खोज सकें।
- क्रॉलर (Crawler/Spider/Bot)
- खोज इंजनों द्वारा विकसित वेब पेज सामग्री को स्वचालित रूप से क्रॉल करने वाला प्रोग्राम, जैसे Googlebot (Google क्रॉलर), Bingbot (Bing क्रॉलर), Baiduspider (Baidu क्रॉलर), पेज लिंक को ट्रैक करके और Sitemap फ़ाइल पढ़कर नए पेज खोजता है, पेज सामग्री डाउनलोड करने के बाद खोज इंजन इंडेक्स लाइब्रेरी में संग्रहीत करता है।
- क्रॉल बजट (Crawl Budget)
- खोज इंजन द्वारा एक निश्चित समय अवधि में किसी वेबसाइट को आवंटित कुल क्रॉल संसाधन मात्रा, वेबसाइट डोमेन प्राधिकरण, सर्वर प्रतिक्रिया गति, पेज सामग्री गुणवत्ता, ऐतिहासिक क्रॉल प्रभाव आदि कई कारकों द्वारा संयुक्त रूप से निर्धारित होती है, सही ढंग से Sitemap कॉन्फ़िगर करने से क्रॉल बजट के उपयोग दक्षता को अनुकूलित करने में मदद मिल सकती है।
- UTF-8 एन्कोडिंग
- Sitemap XML फ़ाइल के लिए अनिवार्य रूप से उपयोग की जाने वाली वर्ण एन्कोडिंग, UTF-8 चीनी सहित सभी Unicode वर्णों का समर्थन करती है, XML घोषणा में encoding="UTF-8" विशेषता के माध्यम से निर्दिष्ट की जाती है, अन्य एन्कोडिंग (जैसे GBK, GB2312) का उपयोग करने से चीनी URL गड़बड़ वर्ण और पार्सिंग विफलता हो सकती है।
- gzip संपीड़न
- Sitemap प्रोटोकॉल gzip एल्गोरिदम का उपयोग करके संपीड़ित ट्रांसमिशन का समर्थन करता है (फ़ाइल एक्सटेंशन .xml.gz), Sitemap फ़ाइल के आकार को 70%-80% कम कर सकता है, सर्वर बैंडविड्थ और क्रॉलर क्रॉल समय को काफी बचाता है, प्रमुख खोज इंजन स्वचालित रूप से gzip-संपीड़ित Sitemap फ़ाइलों को डीकंप्रेस करके प्रोसेस कर सकते हैं, संपीड़न के बाद भी 50MB आकार सीमा का पालन करना चाहिए।
- Yoast SEO
- WordPress, Shopify जैसे CMS प्लेटफ़ॉर्म पर व्यापक रूप से उपयोग किया जाने वाला SEO प्लगइन, स्वचालित रूप से Sitemap, meta टैग, ब्रेडक्रंब नेविगेशन, XML साइट मानचित्र, RSS ऑप्टिमाइज़ेशन, सोशल मीडिया मेटाडेटा आदि SEO-संबंधित कार्य生成 कर सकता है, सामग्री-प्रधान वेबसाइटों के लिए सामान्य SEO समाधान है।
- इंडेक्स कवरेज (Index Coverage)
- Google Search Console में मुख्य रिपोर्ट में से एक, वेबसाइट के पेजों को Google द्वारा इंडेक्स किए जाने, बहिष्कृत किए जाने, त्रुटि होने, चेतावनी होने की विशिष्ट संख्या और कारण विवरण विस्तार से दिखाती है, Sitemap सबमिशन प्रभाव को सत्यापित करने और पेज इंडेक्सिंग समस्याओं का निदान करने के लिए उपयोग की जा सकती है।
- URL एन्कोडिंग (Percent-Encoding)
- इसे परसेंट-एन्कोडिंग भी कहा जाता है, URL में गैर-ASCII वर्णों (जैसे चीनी, विशेष प्रतीक) को दर्शाने के लिए एन्कोडिंग विधि, चीनी वर्णों को %XX%XX%XX रूप में एन्कोड किया जाता है (जैसे "चीनी" को %E4%B8%AD%E6%96%87 के रूप में एन्कोड किया जाता है), Sitemap में चीनी URL को सही ढंग से एन्कोड किया जाना चाहिए ताकि पार्स किया जा सके।
changefreq अपडेट आवृत्ति परिदृश्य तुलना तालिका
| changefreq मान | अपडेट आवृत्ति | विशिष्ट उपयुक्त पेज प्रकार | ध्यान देने योग्य बातें |
|---|---|---|---|
always | हर बार एक्सेस करने पर बदल सकता है | रीयल-टाइम डेटा पेज, खोज एंट्री, डायनेमिक एग्रीगेशन पेज | इसका मतलब यह नहीं है कि क्रॉलर हर बार आएगा, बस परिवर्तन आवृत्ति बहुत अधिक है; दुरुपयोग न करें, सामान्य पेजों को always पर सेट न करें |
hourly | प्रति घंटा अपडेट | समाचार होमपेज, सोशल मीडिया डायनेमिक्स, रीयल-टाइम कोटेशन पेज | ऐसे पेजों के लिए उपयुक्त जहां हर घंटे नई सामग्री उत्पन्न होती है, गैर-उच्च आवृत्ति अपडेट साइटों को hourly पर सेट न करें |
daily | दैनिक अपडेट | वेबसाइट होमपेज, ब्लॉग सूची पेज, समाचार चैनल पेज, उत्पाद श्रेणी पेज | सबसे अधिक उपयोग किए जाने वाले मानों में से एक, अधिकांश साइटों के होमपेज और सेक्शन पेजों के लिए उपयुक्त |
weekly | साप्ताहिक अपडेट | सामान्य लेख विवरण पेज, उत्पाद विवरण पेज, ब्लॉग मुख्य पेज | अधिकांश सामग्री-प्रधान वेबसाइटों के मुख्य पेजों के लिए यह उपयुक्त है |
monthly | मासिक अपडेट | श्रेणी निर्देशिका पेज, आर्काइव पेज, FAQ पेज, उपयोग गाइड पेज | सामग्री अपडेट कम बार होने वाले लेकिन कभी-कभी समायोजित होने वाले सहायक पेज |
yearly | वार्षिक अपडेट | कंपनी परिचय पेज, संपर्क पेज, सेवा शर्तें, गोपनीयता नीति | लगभग कभी भी परिवर्तित न होने वाले स्टैटिक जानकारी पेज |
never | कभी भी अपडेट नहीं | ऐतिहासिक लेख आर्काइव, समाप्त इवेंट पेज, आर्काइव पुरानी सामग्री | निश्चित रूप से संशोधित नहीं होने वाले पेजों को never पर सेट करें, यदि अपडेट होता है तो समय पर वापस बदलना याद रखें |
priority प्राथमिकता सेटिंग संदर्भ तालिका
| priority मान | प्राथमिकता स्तर | उपयुक्त पेज प्रकार | अनुशंसित पेज संख्या अनुपात |
|---|---|---|---|
1.0 | उच्चतम | वेबसाइट होमपेज, मुख्य लैंडिंग पेज, सबसे महत्वपूर्ण चैनल एंट्री | पूरी वेबसाइट में केवल 1-3 पेज |
0.8-0.9 | बहुत उच्च | मुख्य सेक्शन पेज, लोकप्रिय श्रेणी पेज, मुख्य उत्पाद पेज, महत्वपूर्ण विशेष विषय | कुल पेज संख्या का लगभग 5-10% |
0.6-0.7 | अपेक्षाकृत उच्च | मामूली सेक्शन पेज, उप-श्रेणी पेज, लोकप्रिय लेख, महत्वपूर्ण उत्पाद विवरण | कुल पेज संख्या का लगभग 10-20% |
0.4-0.5 | सामान्य | सामान्य लेख विवरण पेज, सामान्य उत्पाद पेज, नियमित सामग्री पेज | कुल पेज संख्या का लगभग 40-60% (डिफ़ॉल्ट मान) |
0.2-0.3 | अपेक्षाकृत कम | टैग पेज, आर्काइव पेजिनेशन, पुराने लेख आर्काइव, सहायक पेज | कुल पेज संख्या का लगभग 15-25% |
0.0-0.1 | सबसे कम | कम मूल्य वाले पेज, डुप्लिकेट सामग्री पेज, जिन पेजों को प्रमुखता से क्रॉल नहीं करना चाहते | कुल पेज संख्या का लगभग 5% के भीतर, 0 का मतलब इंडेक्सिंग प्रतिबंधित नहीं है |
Sitemap प्रोटोकॉल विनिर्देश प्रतिबंध तालिका
| प्रतिबंध आइटम | अधिकतम मान | विवरण | सीमा पार होने पर समाधान |
|---|---|---|---|
| एकल Sitemap में शामिल URL संख्या | 50,000 | sitemap.org 0.9 प्रोटोकॉल कठोर नियम | Sitemap Index का उपयोग करके कई उप-Sitemap में विभाजित करें |
| एकल Sitemap बिना संपीड़ित फ़ाइल आकार | 50MB (52428800 बाइट) | सभी टैग और रिक्त स्थान सहित मूल फ़ाइल आकार | gzip संपीड़न का उपयोग करें, Sitemap विभाजित करें, टिप्पणियां हटाएं |
| Sitemap Index में शामिल उप-Sitemap संख्या | 50,000 | अनुक्रमणिका फ़ाइल स्वयं की URL प्रविष्टि प्रतिबंध | सैद्धांतिक रूप से 2.5 बिलियन URL का समर्थन करता है, सामान्य वेबसाइटों को इसकी आवश्यकता नहीं होती |
| एकल URL लंबाई | 2,048 वर्ण | प्रोटोकॉल, डोमेन, पथ, सभी क्वेरी पैरामीटर शामिल | URL बहुत लंबा होने पर पैरामीटर सरल बनाएं या URL रीराइट करें |
| Sitemap द्वारा समर्थित एन्कोडिंग फ़ॉर्मेट | UTF-8 | प्रोटोकॉल अनिवार्य आवश्यकता, अन्य एन्कोडिंग पार्सिंग विफलता का कारण बन सकती है | फ़ाइल सहेजते समय UTF-8 एन्कोडिंग का उपयोग सुनिश्चित करें |
| Sitemap द्वारा समर्थित प्रोटोकॉल | http:// या https:// | URL में पूर्ण प्रोटोकॉल हेडर शामिल होना चाहिए | ftp:// आदि अन्य प्रोटोकॉल समर्थित नहीं हैं |
| सबमिशन के बाद क्रॉलर प्रतिक्रिया समय | कुछ घंटों से कुछ दिनों तक | वेबसाइट प्राधिकरण और Sitemap जटिलता पर निर्भर करता है | बार-बार सबमिट करने की आवश्यकता नहीं, प्रोसेसिंग के लिए धैर्यपूर्वक प्रतीक्षा करें |
| gzip संपीड़न के बाद फ़ाइल आकार | 50MB | संपीड़न के बाद की फ़ाइल भी 50MB सीमा से अधिक नहीं होनी चाहिए | संपीड़न के बाद भी सीमा पार होने पर Sitemap को विभाजित करना अभी भी आवश्यक है |
- Authentication Header जनरेटर
- Cache-Control पार्सर
- Content-Disposition पार्सर
- CORS हेडर जनरेटर
- CORS निरीक्षक
- CSP बिल्डर
- cURL से कोड जनरेटर
- वैश्विक DNS प्रचार जांच
- DNS लुकअप
- Forwarded हेडर पार्सर
- hreflang जनरेटर
- HSTS एनालाइजर
- HTTP कुकी पार्सर
- HTTP हेडर चेकर
- HTTP रिक्वेस्ट रनर
- HTTP स्टेटस कोड लुकअप
- आईपी लुकअप
- IPv4 कनवर्टर
- IPv4 रेंज एक्सपैंडर
- IPv6 टूलबॉक्स
- Link हेडर पार्सर
- MX लुकअप
- पोर्ट चेकर
- URL पैरामीटर बिल्डर
- Rate Limit हेडर पार्सर
- रीडायरेक्ट चेकर
- Robots.txt जेनरेटर
- robots.txt इंस्पेक्टर
- सिक्योरिटी हेडर चेकर
- security.txt जनरेटर
- Set-Cookie पार्सर
- साइट नेटवर्क ऑडिट
- Sitemap जनरेटर
- Sitemap इंस्पेक्टर
- SSL प्रमाणपत्र जांचकर्ता
- सबनेट कैलकुलेटर
- URL पार्सर
- User-Agent पार्सर
- UTM लिंक जेनरेटर
- WebSocket परीक्षक
- What Is My IP?
- WHOIS लुकअप