तकनीकी SEO
HTTP Link Header SEO जांचकर्ता
एक URL दर्ज करें। हम इसे सर्वर-साइड पर फ़ेच करेंगे और RFC 8288 के अनुसार HTTP Link रिस्पॉन्स हेडर में rel="canonical", rel="alternate" hreflang, और rel="next"/"prev" प्रविष्टियों को पार्स करेंगे — फिर उन्हें उसी पेज के HTML <link> टैग से मिलाकर किसी भी टकराव को चिह्नित करेंगे।
reCAPTCHA द्वारा सुरक्षित। हम URL को सर्वर-साइड पर फ़ेच करते हैं (SSRF से सुरक्षित) और केवल इसके रिस्पॉन्स हेडर पढ़ते हैं — कुछ भी संग्रहीत नहीं किया जाता।
Link header क्यों मायने रखता है
लगभग हर canonical और hreflang जांचकर्ता केवल पेज के <head> में मौजूद HTML <link> टैग को देखता है। RFC 8288 उन्हीं सिग्नल को घोषित करने के लिए एक दूसरा, उतना ही मान्य स्थान परिभाषित करता है: HTTP Link: रिस्पॉन्स हेडर। Google इसे स्पष्ट रूप से दस्तावेज़ित करता है और मानता है, WordPress और कई CDN इसे स्वचालित रूप से भेजते हैं, और यह किसी non-HTML संसाधन — PDF, इमेज, JSON API रिस्पॉन्स — के लिए canonical या hreflang सेट करने का एकमात्र तरीका है, क्योंकि इनमें <link> टैग रखने के लिए <head> होता ही नहीं। चूंकि इसे कहीं भी रेंडर नहीं किया जाता, इसलिए CDN edge नियम द्वारा सेट किया गया कोई हेडर जो चुपचाप HTML टैग से भिन्न हो, या कोई PDF जिसके बारे में किसी ने इस तरह canonical सेट करने के बारे में सोचा ही नहीं, ब्राउज़र में और केवल HTML पढ़ने वाले किसी भी टूल में पूरी तरह अदृश्य रहता है।
यह टूल क्या जांचता है
एक असली RFC 8288 पार्सर — regex अनुमान नहीं — जो आपके सर्वर द्वारा भेजे गए वास्तविक रिस्पॉन्स हेडर को पढ़ता है।
RFC 8288 के अनुसार Link header पार्सिंग
कच्चे Link: हेडर मान को — जिसमें कॉमा से अलग की गई कई प्रविष्टियां, उद्धरण-चिह्नित पैरामीटर, और बहु-मान वाली rel सूचियां शामिल हैं — संरचित rel=canonical, rel=alternate, और rel=next/prev प्रविष्टियों में पार्स करता है, और किसी भी ऐसे हिस्से को चिह्नित करता है जो वैध link-value के रूप में पार्स नहीं होता।
हेडर बनाम HTML canonical टकराव
हेडर के rel="canonical" लक्ष्य की तुलना पेज के HTML <link rel="canonical"> टैग से करता है। बेमेल होना एक वास्तविक, चुपचाप छिपी समस्या है: सर्च इंजन इनमें से किसी भी सिग्नल का पालन कर सकते हैं, जिससे canonicalization अनिश्चित हो जाता है। यह हेडर में एक से अधिक canonical, क्रॉस-डोमेन लक्ष्य, और यह फ़ेच किए गए URL को स्वयं संदर्भित करता है या नहीं, इसे भी चिह्नित करता है।
हेडर के माध्यम से hreflang
प्रत्येक rel="alternate"; hreflang="..." हेडर प्रविष्टि के भाषा कोड को सत्यापित करता है, 2 या अधिक प्रविष्टियों में x-default की अनुपस्थिति, स्व-संदर्भित प्रविष्टि की अनुपस्थिति, और अलग-अलग URL की ओर इशारा करने वाले डुप्लिकेट कोड की जांच करता है — फिर टकराव के लिए पूरे सेट की तुलना पेज के HTML hreflang टैग से करता है।
Non-HTML संसाधन कवरेज
किसी PDF, इमेज, या API रिस्पॉन्स के लिए (जिसमें HTML न होने के कारण <link> टैग होना संभव ही नहीं है), उस स्थिति को चिह्नित करता है जब हेडर में कोई canonical नहीं भेजा गया — जिसका अर्थ है कि उस संसाधन में सर्च इंजन के लिए कोई canonicalization सिग्नल ही नहीं है, जिसे पूरी तरह नज़रअंदाज़ करना बहुत आसान है।
अक्सर पूछे जाने वाले प्रश्न
HTTP Link header क्या है और मेरी साइट इसे क्यों भेजेगी?
यह RFC 8288 द्वारा परिभाषित एक रिस्पॉन्स हेडर है, जो सामान्यतः HTML <link> टैग के रूप में लिखे जाने वाले उन्हीं rel-आधारित संबंधों (canonical, alternate, next, prev, और अधिक) को वहन करता है — फ़र्क सिर्फ़ इतना है कि यह किसी भी रिस्पॉन्स के लिए काम करता है, चाहे वह HTML हो या न हो। WordPress कोर कुछ Link हेडर स्वचालित रूप से भेजता है; कई CDN और रिवर्स प्रॉक्सी edge पर इन्हें इंजेक्ट या पुनर्लिखित कर सकते हैं, कभी-कभी मूल साइट को इसकी जानकारी भी नहीं होती।
हेडर का canonical मेरे HTML canonical टैग से अलग है — क्या यह बग है?
लगभग हमेशा, हां। Google का अपना दस्तावेज़ कहता है कि दोनों वैध सिग्नल हैं, लेकिन यह गारंटी नहीं देता कि टकराव होने पर कौन जीतेगा — व्यवहार में इससे केवल उस URL का canonicalization अप्रत्याशित हो जाता है। जांचें कि कहीं कोई CDN, कैशिंग परत, या प्लगइन आपके HTML टेम्पलेट से स्वतंत्र रूप से हेडर इंजेक्ट तो नहीं कर रहा, और दोनों को मिलाएं।
क्या मैं बिना किसी HTML <link> टैग के hreflang का उपयोग कर सकता हूं?
हां — हेडर रूप टैग रूप के पूरी तरह समकक्ष है, और यह non-HTML संसाधनों (उदाहरण के लिए PDF) को hreflang-टैग करने या HTML टेम्पलेट को छुए बिना किसी रिस्पॉन्स में hreflang जोड़ने का मानक तरीका है। वही नियम लागू होते हैं: हर भाषा वेरिएंट को स्वयं को सूची में शामिल करना चाहिए (स्व-संदर्भ), और दो या अधिक वेरिएंट होने पर x-default की सिफ़ारिश की जाती है।
क्या Google वास्तव में Link रिस्पॉन्स हेडर का उपयोग करता है?
हां। Google Search Central का दस्तावेज़ स्पष्ट रूप से HTTP हेडर को rel="canonical" और rel="alternate" hreflang दोनों निर्दिष्ट करने के समर्थित तरीके के रूप में सूचीबद्ध करता है, और विशेष रूप से non-HTML फ़ाइलों को इस तंत्र के अस्तित्व का कारण बताता है।
क्या मेरा URL या उसकी सामग्री कहीं संग्रहीत की जाती है?
नहीं। फ़ेचिंग केवल इस एक जांच के लिए सर्वर-साइड पर होती है और परिणाम सीधे आपके ब्राउज़र को वापस भेजा जाता है; रेट-लिमिट काउंटर के अलावा डेटाबेस या लॉग में कुछ भी नहीं लिखा जाता।