Robots.txt फ़ाइल जनरेटर
अपनी वेबसाइट के लिए आसानी से एक पेशेवर SEO robots.txt फ़ाइल बनाएं।
जनरेटेड रोबोट्स.txt
मुफ़्त Robots.txt फ़ाइल जनरेटर
हमारा मुफ़्त Robots.txt फ़ाइल जनरेटर आपकी वेबसाइट के लिए कुछ ही सेकंड में एक साफ़ और मान्य robots.txt फ़ाइल बना देता है। अपना साइटमैप URL डालें, उन रास्तों की सूची बनाएँ जिन्हें आप ब्लॉक करना चाहते हैं, और एक तैयार फ़ाइल जेनरेट करें जिसे आप कॉपी या डाउनलोड कर सकते हैं। इसके लिए किसी सिंटेक्स ज्ञान की आवश्यकता नहीं है, साइन अप करने की ज़रूरत नहीं है, और हाथ से फ़ाइल लिखने पर होने वाली टाइपिंग की गलतियों का कोई खतरा नहीं है, जिनसे साइट इंडेक्स से हट सकती है।
robots.txt फ़ाइल यह नियंत्रित करती है कि सर्च इंजन आपकी साइट को कैसे क्रॉल करते हैं। एक भी अक्षर गलत होने पर आपकी पूरी वेबसाइट बिना किसी चेतावनी के Google द्वारा ब्लॉक हो सकती है। यह जनरेटर फ़ाइल को फ्री टेक्स्ट के बजाय आपके इनपुट से बनाकर इस जोखिम को खत्म करता है।
Robots.txt फ़ाइल क्या है?
robots.txt फ़ाइल आपके डोमेन के रूट में मौजूद एक साधारण टेक्स्ट फ़ाइल होती है जो सर्च इंजन क्रॉलर को बताती है कि वे किन URL तक पहुंच सकते हैं। यह फ़ाइल yoursite.com/robots.txt पर होती है और क्रॉलिंग से पहले ज़्यादातर बॉट इसी फ़ाइल को चेक करते हैं। यह क्रॉलिंग को नियंत्रित करती है, इंडेक्सिंग को नहीं, इसलिए अगर कोई ब्लॉक किया गया पेज दूसरी साइटों से लिंक करता है, तो वह सर्च परिणामों में दिखाई दे सकता है।
यह फ़ाइल रोबोट्स एक्सक्लूज़न स्टैंडर्ड का पालन करती है, जो कि हर प्रमुख सर्च इंजन द्वारा मान्य प्रोटोकॉल है। Googlebot, Bingbot और अन्य विश्वसनीय क्रॉलर आपकी साइट पर कुछ भी अनुरोध करने से पहले इसे पढ़ते हैं। स्क्रैपर और मैलवेयर बॉट अक्सर इसे पूरी तरह से अनदेखा कर देते हैं, यही कारण है कि robots.txt कभी भी सुरक्षा उपकरण नहीं है।
गूगल के अनुसार, robots.txt में प्रतिबंधित पेज भी अन्य साइटों से लिंक होने पर इंडेक्स हो सकता है, और आमतौर पर बिना विवरण के दिखाई देता है। यदि आपका लक्ष्य किसी पेज को खोज परिणामों से बाहर रखना है, तो नोइंडेक्स टैग या पासवर्ड सुरक्षा सही तरीका है, न कि प्रतिबंधित नियम।
इस Robots.txt जनरेटर का उपयोग कैसे करें
robots.txt फ़ाइल बनाने के लिए, अपना साइटमैप URL दर्ज करें, ब्लॉक किए जाने वाले सभी पाथ को एक-एक पंक्ति में जोड़ें, फिर जनरेट पर क्लिक करें। यह टूल सही फॉर्मेट वाली फ़ाइल तैयार कर देगा जिसे आप कॉपी या डाउनलोड कर सकते हैं। इसे अपनी वेबसाइट के रूट फ़ोल्डर में अपलोड करें ताकि यह yoursite.com/robots.txt पर उपलब्ध हो सके, फिर इसे Google सर्च कंसोल में टेस्ट करें।
- अपना साइटमैप यूआरएल दर्ज करें। यह क्रॉलर को सीधे आपके सबसे महत्वपूर्ण पृष्ठों पर ले जाता है, उदाहरण के लिए https://yoursite.com/sitemap_index.xml।
- अस्वीकृत किए जाने वाले पथ जोड़ें। प्रत्येक पंक्ति में एक ही पथ लिखें, जैसे /wp-admin/ या /cart/। पूर्ण क्रॉलिंग की अनुमति देने के लिए इसे खाली छोड़ दें।
- जनरेट पर क्लिक करें। यह टूल सही सिंटैक्स और स्पेसिंग के साथ एक साफ-सुथरी और मान्य robots.txt फ़ाइल तैयार करता है।
- फाइल को कॉपी या डाउनलोड करें। इसे robots.txt फ़ाइल के रूप में UTF-8 एन्कोडिंग के साथ सेव करें।
- इसे अपनी साइट के रूट फ़ोल्डर में अपलोड करें। और पुष्टि करें कि यह आपकी साइट yoursite.com/robots.txt पर लोड हो रहा है, फिर सर्च कंसोल में मुख्य यूआरएल का परीक्षण करें।
Robots.txt का सिंटैक्स: निर्देशों की व्याख्या
robots.txt फ़ाइल चार मुख्य निर्देशों से बनी होती है। User-agent एक विशिष्ट क्रॉलर को लक्षित करता है, Disallow एक पथ को अवरुद्ध करता है, Allow अवरुद्ध फ़ोल्डर के भीतर एक पथ की अनुमति देता है, और Sitemap आपके XML साइटमैप को इंगित करता है। प्रत्येक नियम अपनी अलग पंक्ति में होता है, पथ केस-संवेदनशील होते हैं, और क्रॉलर सूचीबद्ध पहले नियम के बजाय सबसे सटीक मिलान वाले नियम को लागू करते हैं।
आदेश | यह क्या करता है | उदाहरण |
उपयोगकर्ता एजेंट | उस क्रॉलर का नाम बताता है जिस पर नियम ब्लॉक लागू होता है | उपयोगकर्ता एजेंट: * |
अनुमति न दें | किसी पथ को क्रॉल होने से रोकता है | अनुमति न दें: /wp-admin/ |
अनुमति दें | अवरुद्ध फ़ोल्डर के अंदर एक पथ की अनुमति देता है | अनुमति दें: /wp-admin/admin-ajax.php |
साइट मैप | क्रॉलर को बताता है कि आपका साइटमैप कहाँ स्थित है | साइटमैप: https://site.com/sitemap.xml |
क्रॉल-विलंब | बॉट्स से अनुरोधों के बीच प्रतीक्षा करने के लिए कहता है (Google द्वारा अनदेखा किया गया) | क्रॉल-विलंब: 10 |
तारांकन चिह्न में उपयोगकर्ता एजेंट: * यह एक वाइल्डकार्ड है जिसका अर्थ है सभी क्रॉलर। किसी एक बॉट को लक्षित करने के लिए, उसका नाम सीधे लिखें, जैसे कि उपयोगकर्ता-एजेंट: गूगलबॉट. एक खाली 'अलाउ' मान सब कुछ अनुमति देता है, जबकि अनुमति न दें: / पूरी साइट को ब्लॉक कर देता है।
क्या अनुमति दें और क्या अस्वीकार करें
ऐसे पाथ को ब्लॉक करें जिनका कोई सर्च वैल्यू नहीं है और जो क्रॉल बजट को बर्बाद करते हैं, जैसे एडमिन पेज, कार्ट और चेकआउट यूआरएल, आंतरिक खोज परिणाम और डुप्लिकेट फ़िल्टर यूआरएल। कभी भी सीएसएस, जावास्क्रिप्ट या इमेज फ़ोल्डर को ब्लॉक न करें जिनकी सर्च इंजन को आपके पेज को रेंडर करने के लिए आवश्यकता होती है, क्योंकि जो पेज ठीक से रेंडर नहीं हो पाता, इंडेक्सिंग के दौरान उसकी गुणवत्ता का गलत आकलन हो सकता है।
अधिकांश साइटों पर अवरुद्ध करने योग्य सामान्य पथों में निम्नलिखित शामिल हैं:
- /wp-admin/ अनुमति देते हुए /wp-admin/admin-ajax.php
- आंतरिक खोज परिणाम पृष्ठ जैसे /?s=
- ईकॉमर्स स्टोर पर कार्ट, चेकआउट और खाता यूआरएल
- स्टेजिंग या डेवलपमेंट फ़ोल्डर
- बिना किसी खोज उद्देश्य के धन्यवाद और पुष्टिकरण पृष्ठ
सर्च इंजन क्रॉल बजट पर काम करते हैं, यानी एक निश्चित समय सीमा में बॉट द्वारा क्रॉल किए जाने वाले पेजों की संख्या। कम महत्व वाले सेक्शन को ब्लॉक करने से क्रॉलर उस बजट को उन पेजों पर खर्च कर पाते हैं जो वास्तव में ट्रैफिक लाते हैं। साइट के विकास के साथ यह और भी महत्वपूर्ण हो जाता है, क्योंकि एक रिपोर्ट के अनुसार 91% पेजों को Google से कोई ऑर्गेनिक ट्रैफिक नहीं मिलता है। अहरेफ़्सऔर क्रॉल वेस्ट उस अंतर को और भी बढ़ा देता है।
2026 में एआई क्रॉलर को नियंत्रित करना
आधुनिक robots.txt फ़ाइल अब केवल Googlebot और Bingbot तक सीमित नहीं है। अब आप GPTBot, ClaudeBot, Google-Extended और PerplexityBot जैसे AI क्रॉलर, साथ ही AhrefsBot और SemrushBot जैसे SEO क्रॉलर को भी अनुमति दे सकते हैं या ब्लॉक कर सकते हैं। प्रत्येक को उसके अपने User-agent ब्लॉक द्वारा नियंत्रित किया जाता है, जिससे आपको यह तय करने का सीधा अधिकार मिलता है कि कौन से बॉट प्रशिक्षण या इंडेक्सिंग के लिए आपकी सामग्री तक पहुंच सकते हैं।
यदि आप किसी विशिष्ट एआई क्रॉलर को अपनी सामग्री का उपयोग करने से रोकना चाहते हैं, तो उसके लिए एक अलग ब्लॉक जोड़ें:
- उपयोगकर्ता-एजेंट: जीपीटीबॉट तब अनुमति न दें: / ब्लॉक OpenAI का क्रॉलर
- उपयोगकर्ता-एजेंट: Google-विस्तारित तब अनुमति न दें: / सामान्य खोज क्रॉलिंग को जारी रखते हुए Google AI प्रशिक्षण से बाहर निकलने का विकल्प चुनता है
- उपयोगकर्ता-एजेंट: CCBot तब अनुमति न दें: / यह कई एआई डेटासेट द्वारा उपयोग किए जाने वाले कॉमन क्रॉल बॉट को ब्लॉक करता है।
इन सर्च इंजन को ब्लॉक करने से आपकी सामान्य Google या Bing सर्च रैंकिंग पर कोई असर नहीं पड़ता, क्योंकि वे अलग-अलग यूजर एजेंट का इस्तेमाल करते हैं। यह पूरी तरह से AI और थर्ड-पार्टी डेटा एक्सेस पर नियंत्रण है।
वर्डप्रेस के लिए Robots.txt
वर्डप्रेस स्वचालित रूप से एक वर्चुअल robots.txt फ़ाइल बनाता है, लेकिन एक कस्टम फ़ाइल अपलोड करने से आपको पूरा नियंत्रण मिलता है। एक सुरक्षित वर्डप्रेस सेटअप एडमिन एरिया और आंतरिक खोज को ब्लॉक करता है, जबकि admin-ajax.php को अनुमति देता है और आपके साइटमैप को प्रदर्शित करता है। /wp-content/ फ़ोल्डर को कभी भी पूरी तरह से ब्लॉक न करें, क्योंकि इसमें थीम और प्लगइन फ़ाइलें होती हैं जिनकी Google को आपके पेजों को प्रदर्शित करने के लिए आवश्यकता होती है।
वर्डप्रेस साइट के लिए एक साफ-सुथरा शुरुआती टेम्पलेट कुछ इस तरह दिखता है:
उपयोगकर्ता एजेंट: *
अनुमति न दें: /wp-admin/
अनुमति न दें: /?s=
अनुमति दें: /wp-admin/admin-ajax.php
साइटमैप: https://yoursite.com/sitemap_index.xml
अपनी साइटमैप URL डालें, ऊपर दी गई फ़ाइल जनरेट करें और उसे अपनी रूट डायरेक्टरी में अपलोड करें। यदि आप ई-कॉमर्स स्टोर चलाते हैं, तो कार्ट, चेकआउट और माय-अकाउंट पाथ को डिसअलाउ लिस्ट में जोड़ें।
Robots.txt में होने वाली आम गलतियाँ जिनसे बचना चाहिए
robots.txt में सबसे बड़ी गलती Disallow: / को लाइव फाइल में छोड़ देना है, जिससे आपकी पूरी साइट ब्लॉक हो जाती है। अन्य आम गलतियों में CSS और JavaScript फाइलों को ब्लॉक करना, संवेदनशील पेजों को लिस्ट करना जिन्हें फाइल बाद में सार्वजनिक रूप से विज्ञापित करती है, और यह मान लेना कि robots.txt Google के इंडेक्स से पेजों को हटा देता है जबकि यह केवल क्रॉलिंग को नियंत्रित करता है।
- आकस्मिक पूर्ण ब्लॉक। एक आवारा अनुमति न दें: / यह सभी क्रॉलर को आपकी पूरी साइट को अनदेखा करने के लिए कहता है। ऐसा अक्सर तब होता है जब माइग्रेशन के दौरान किसी स्टेजिंग फ़ाइल को लाइव किया जाता है।
- रेंडरिंग के लिए महत्वपूर्ण फाइलों को ब्लॉक करना। थीम सीएसएस या जेएस को अनुमति न देने से गूगल आपके पेज को वैसे नहीं देख पाता जैसे कोई उपयोगकर्ता देखता है, जिससे रैंकिंग पर बुरा असर पड़ सकता है, खासकर एलिमेंटर जैसे विजुअल बिल्डर्स पर।
- गोपनीयता के लिए robots.txt का उपयोग करना। यह फ़ाइल सार्वजनिक है, इसलिए संवेदनशील पथ को सूचीबद्ध करने से सभी को पता चल जाएगा कि यह कहाँ स्थित है। इसके बजाय पासवर्ड सुरक्षा या नोइंडेक्स का उपयोग करें।
- केस संवेदनशीलता। पथ केस-संवेदनशील होते हैं, इसलिए /तस्वीर/ और /तस्वीर/ इन्हें अलग-अलग निर्देशिकाओं के रूप में माना जाता है।
फाइल को हाथ से लिखने के बजाय जनरेटर का उपयोग करने से इनमें से लगभग सभी जोखिम दूर हो जाते हैं, क्योंकि हर बार आपके इनपुट से सिंटैक्स सही ढंग से बनता है।
Robots.txt बनाम Sitemap बनाम Noindex
ये तीनों अलग-अलग काम करते हैं। Robots.txt यह नियंत्रित करता है कि क्रॉलर किन रास्तों तक पहुँच सकते हैं, साइटमैप उन URL की सूची बनाता है जिन्हें आप क्रॉल और इंडेक्स करवाना चाहते हैं, और noindex टैग क्रॉल करने योग्य पेज को खोज परिणामों से बाहर रखता है। एक बेहतर तकनीकी SEO सेटअप robots.txt और साइटमैप दोनों का एक साथ उपयोग करता है, और noindex टैग उन पेजों के लिए आरक्षित रखता है जिन्हें Google से बाहर रखना ज़रूरी है।
एक आम गलती इन संकेतों का विरोधाभास करना है, उदाहरण के लिए, अपने साइटमैप में एक URL सूचीबद्ध करना जबकि उसे robots.txt में ब्लॉक करना। यदि आप किसी पेज को खोज परिणामों से हटाना चाहते हैं, तो क्रॉलिंग की अनुमति दें और एक noindex टैग जोड़ें, क्योंकि Google उस पेज पर noindex टैग को नहीं पढ़ सकता जिसे क्रॉल करने की अनुमति नहीं है। अधिक विस्तृत जानकारी के लिए, हमारे गाइड देखें। एसईओ ब्लॉग.
सही तरीके से बनाई गई Robots.txt फ़ाइल आपके SEO में कैसे मदद करती है?
सही तरीके से कॉन्फ़िगर की गई robots.txt फ़ाइल, क्रॉलर को आपके महत्वपूर्ण पेजों की ओर निर्देशित करके और कम महत्वपूर्ण पेजों से दूर रखकर SEO को बेहतर बनाती है, जिससे क्रॉल बजट की बचत होती है और महत्वपूर्ण सामग्री को तेज़ी से इंडेक्स करने में मदद मिलती है। हालांकि robots.txt सीधे तौर पर रैंकिंग को प्रभावित नहीं करती, लेकिन क्रॉल दक्षता सीधे तौर पर यह प्रभावित करती है कि आपकी साइट को कितनी जल्दी और पूरी तरह से प्रोसेस किया जाता है।
बैकलिंक्स गूगल के शीर्ष तीन रैंकिंग कारकों में से एक हैं, और यदि क्रॉल संबंधी समस्याओं के कारण आपके सर्वश्रेष्ठ पेज सही ढंग से प्रोसेस नहीं हो पाते हैं, तो अर्जित की गई वह सारी अथॉरिटी मायने नहीं रखती। डोमेन प्राधिकरण1 से 100 तक का मोज़ स्कोर, जो मुख्य रूप से बैकलिंक संकेतों पर आधारित होता है, उन साइटों पर सबसे तेज़ी से बढ़ता है जहाँ क्रॉलिंग और इंडेक्सिंग सुचारू रूप से चलती है। एक बार जब आपकी robots.txt फ़ाइल सेट हो जाए, तो हमारे टूल का उपयोग करके अपनी अथॉरिटी की जाँच करें। मुफ़्त डीए पीए टूल और हमारे टूल का उपयोग करके क्रॉल-वेस्टिंग डेड लिंक्स को स्कैन करें बल्क ब्रोकन लिंक चेकर.
अक्सर पूछे जाने वाले प्रश्नों
क्या यह robots.txt जनरेटर मुफ्त है?
जी हां, हमारा Robots.txt फ़ाइल जनरेटर पूरी तरह से मुफ़्त है, इसके लिए किसी साइनअप या सीमा की आवश्यकता नहीं है। अपना साइटमैप दर्ज करें और पाथ को प्रतिबंधित करें, फ़ाइल जनरेट करें और इसे तुरंत कॉपी या डाउनलोड करें। आप हमारी संपूर्ण सेवा सुविधाओं के साथ, अपनी साइट संरचना में किसी भी परिवर्तन के समय अपडेटेड फ़ाइल जनरेट करने के लिए वापस आ सकते हैं। मुफ़्त एसईओ उपकरण.
robots.txt फाइल जनरेट करने के बाद उसे कहाँ रखना है?
इसे अपनी वेबसाइट के रूट डायरेक्टरी में अपलोड करें ताकि यह yoursite.com/robots.txt पर लोड हो सके। यह किसी सबफ़ोल्डर में काम नहीं करेगा। वर्डप्रेस पर, आप इसे FTP के माध्यम से अपलोड कर सकते हैं या इसकी सामग्री को अपने SEO प्लगइन के robots.txt एडिटर में पेस्ट कर सकते हैं, जैसे कि Yoast या Rank Math।
क्या robots.txt फ़ाइल मेरी वेबसाइट के पेजों को Google से हटा देती है?
नहीं। Robots.txt केवल क्रॉलिंग को नियंत्रित करता है, इंडेक्सिंग को नहीं। यदि अन्य साइटें किसी अवरुद्ध पृष्ठ से लिंक करती हैं, तो वह पृष्ठ खोज परिणामों में दिखाई दे सकता है, आमतौर पर बिना किसी विवरण के। किसी पृष्ठ को खोज परिणामों से हटाने के लिए, क्रॉल करने योग्य पृष्ठ पर noindex टैग का उपयोग करें या उसे पासवर्ड से सुरक्षित करें।
क्या मैं robots.txt का उपयोग करके GPTBot जैसे AI क्रॉलर को ब्लॉक कर सकता हूँ?
जी हां। बॉट के लिए एक अलग यूजर-एजेंट ब्लॉक जोड़ें, जैसे कि GPTBot, ClaudeBot, या Google-Extended, और फिर उसे ब्लॉक करने के लिए Disallow: / लगाएं। इससे AI क्रॉलर आपके कंटेंट तक नहीं पहुंच पाएगा, लेकिन आपके सामान्य Google या Bing सर्च रैंकिंग पर कोई असर नहीं पड़ेगा, क्योंकि वे अलग-अलग यूजर एजेंट का इस्तेमाल करते हैं।
robots.txt फ़ाइल अपलोड करने के बाद मैं उसे कैसे टेस्ट करूँ?
Google Search Console खोलें और कुछ मुख्य पेजों पर URL Inspection टूल का उपयोग करके पुष्टि करें कि वे अनजाने में ब्लॉक तो नहीं हो रहे हैं। बदलाव करने से पहले और बाद में हमेशा जांच करें, क्योंकि एक गलत अक्षर भी अपेक्षा से कहीं अधिक पेजों को ब्लॉक कर सकता है। इसके साथ ही, हमारे टूल का उपयोग करके त्वरित अथॉरिटी चेक भी करें। बल्क डोमेन अथॉरिटी चेकर.
अब अपनी Robots.txt फ़ाइल जेनरेट करें
ऊपर स्क्रॉल करें, अपना साइटमैप URL और ब्लॉक किए जाने वाले सभी पाथ दर्ज करें, और कुछ ही सेकंड में एक साफ़ और मान्य robots.txt फ़ाइल जेनरेट करें। यह मुफ़्त है, इसके लिए किसी साइनअप की आवश्यकता नहीं है, और फ़ाइल को हाथ से लिखने से होने वाली टाइपिंग की गलतियों का जोखिम भी खत्म हो जाता है। एक बार आपका क्रॉल सेटअप तैयार हो जाने के बाद, हमारे अन्य विकल्पों को देखें। एसईओ टूल का पूरा सेट या फिर हमारे विशेषज्ञों से दूसरी राय लें। विशेषज्ञ एसईओ सलाहकार सेवा।