Canonical टैग चेकर: Canonical, रीडायरेक्ट और Noindex एक साथ | We.Inc
पेज का HTML और response headers डालकर उसका canonical टैग, इंडेक्स कराने वाले URL, HTTP स्थिति, रीडायरेक्ट और noindex जांचें। विरोधी संकेत समझें और सुधार की चेकलिस्ट डाउनलोड करें।
पेज का पता और वह पता डालें जिसे आप सर्च इंजन से इंडेक्स कराना चाहते हैं, फिर पेज का HTML सोर्स और उपलब्ध हों तो response headers चिपकाएं। चेकर canonical टैग, canonical HTTP header, robots meta टैग और X-Robots-Tag, status code तथा रीडायरेक्ट क्रम पढ़कर बताता है कि वे कहां एक-दूसरे से मेल नहीं खाते। यह दूसरी वेबसाइटों पर नहीं जाता: ब्राउज़र एक साइट को दूसरी साइट पढ़ने से रोकते हैं और हम छिपा हुआ crawler नहीं चलाते। आपको जो टेक्स्ट चाहिए वह आप चिपकाते हैं और टूल उसी की जांच करता है। पेज पर headers और HTML पाने के लिए एक-पंक्ति कमांड दिए हैं।
जांचा गया URL और इंडेक्स कराने के लिए पसंदीदा URL डालें (अक्सर दोनों एक ही होते हैं)।
टर्मिनल में URL के बाद curl -sIL चलाकर headers लें और नतीजा चिपकाएं। इससे हर redirect hop और अंतिम status code दिखता है।
ब्राउज़र में View Source (Ctrl+U या Cmd+Option+U) खोलकर या URL के बाद curl -sL चलाकर HTML लें और चिपकाएं।
चेकर HTML और Link header में हर rel=canonical, robots meta टैग और X-Robots-Tag तथा हर hop का status ढूंढता है।
हर जांच बताती है कि नतीजा त्रुटि है, देखने योग्य बात है या ठीक है, और ऐसा क्यों है। जानकारी नहीं दी हो तो उसे जांचा नहीं गया बताया जाता है, कभी पास नहीं।
साइट संपादित करने वाले व्यक्ति के लिए सुधार की चेकलिस्ट टेक्स्ट फ़ाइल के रूप में डाउनलोड करें।
Canonical ऐसे पेज पर जाना चाहिए जो 200 status देता हो, रीडायरेक्ट न हो, noindex न हो और उसी सामग्री वाला हो।
हर पेज पर एक ही canonical रखें। दो अलग canonical हों या टैग और header में असहमति हो तो सर्च इंजन दोनों को अनदेखा कर सकते हैं।
https और अपने चुने हुए www या non-www होस्ट के साथ पूरे URL इस्तेमाल करें।
किसी दूसरे पेज के canonical के साथ noindex न जोड़ें। एक निर्देश कहता है इस पेज को हटाओ और दूसरा कहता है इसे मिलाओ; इनमें से एक चुनें।
Canonical एक सुझाव है, आदेश नहीं। उसी विकल्प के लिए रीडायरेक्ट और एक-जैसे आंतरिक लिंक अधिक मज़बूत संकेत हैं।
अक्सर पूछे जाने वाले सवाल
मुझे HTML क्यों चिपकाना पड़ता है?
ब्राउज़र किसी वेब पेज को दूसरी वेबसाइट की सामग्री पढ़ने से रोकते हैं, इसलिए ब्राउज़र में चलने वाला टूल आपका पेज खुद नहीं ला सकता। जो टूल ऐसा करते दिखते हैं, वे अपने सर्वर से पेज मंगाते हैं। हमने यह टूल पूरी तरह आपके ब्राउज़र में रखने और सोर्स पाने का तरीका स्पष्ट बताने का विकल्प चुना।
Canonical टैग क्या करता है?
जब एक ही सामग्री कई पतों पर उपलब्ध हो, जैसे ट्रैकिंग पैरामीटर के साथ और बिना, तो यह सर्च इंजन को पेज का मुख्य पता बताता है। सर्च इंजन आमतौर पर इसे मानते हैं, लेकिन दूसरे संकेत असहमत हों तो कोई और URL चुन सकते हैं।
क्या हर पेज का canonical उसी पेज पर होना चाहिए?
यह एक अच्छा डिफ़ॉल्ट है। पेज पर खुद जाने वाला canonical पैरामीटर, बड़े-छोटे अक्षर या आखिर में लगे स्लैश से बनी प्रतियों से बचाता है।
Canonical न होना और पेज न ला पाना, इनमें क्या अंतर है?
यहां canonical न होने का मतलब है कि आपने जो HTML चिपकाया उसमें rel=canonical नहीं है। अगर आप कुछ नहीं चिपकाते या त्रुटि वाला पेज चिपकाते हैं, तो चेकर कहता है कि HTML की जांच नहीं हुई, ताकि पेज लाने में हुई विफलता को टैग की कमी न समझें।
क्या Google हमेशा मेरा canonical इस्तेमाल करता है?
नहीं। Google इसे एक मज़बूत संकेत मानता है। Search Console का URL Inspection टूल दिखाता है कि Google ने असल में कौन-सा canonical चुना।
एक-दूसरे से टकराते संकेत
अधिकांश canonical समस्याएं विरोधाभास हैं: रीडायरेक्ट पर जाने वाला canonical, दूसरे पेज का canonical लेकिन पेज पर noindex, HTML का टैग HTTP header से अलग होना या https साइट पर http का canonical। हर स्थिति सर्च इंजन को एक साथ दो बातें बताती है, फिर वे आपके लिए फैसला करते हैं।
Canonical को status code, रीडायरेक्ट और robots निर्देशों के साथ जांचने पर ये विरोधाभास सामने आते हैं। सिर्फ टैग पढ़ने वाला चेकर इनमें से अधिकतर को नहीं पकड़ता।
काम करके दिखाया गया उदाहरण
पेज पर दिया उदाहरण खोलें: example.com पर एक काल्पनिक सेवा पेज, जो http से https पर रीडायरेक्ट होकर खुलता है, लेकिन उसका canonical www होस्ट पर स्लैश के साथ http पते पर जाता है। चेकर रीडायरेक्ट, http वाला canonical, दूसरे होस्ट पर जाने वाला canonical और पसंदीदा URL से मेल न होना दिखाता है, साथ ही हर समस्या का समाधान बताता है।