तकनीकी SEO

Title और Meta Description डुप्लिकेट ऑडिटर

पेजों की निर्यात की गई सूची पेस्ट करें — URL, title, और meta description, प्रति पंक्ति एक पेज — और डुप्लिकेट टैग, गायब टैग, तथा सर्च-रिज़ल्ट ट्रंकेशन जोखिम के लिए एक साथ सभी का ऑडिट करें।

टैब, पाइप या कॉमा से अलग की गई पंक्तियों को स्वीकार करता है (स्प्रेडशीट पेस्ट या CSV एक्सपोर्ट जैसे-का-वैसा काम करता है)। प्रति रन अधिकतम 300 पंक्तियाँ; description कॉलम वैकल्पिक है।

यह टूल क्या जाँचता है

बड़ी साइटों पर डुप्लिकेट और गायब title टैग सबसे आम तकनीकी SEO समस्याओं में से एक हैं — ये आमतौर पर किसी एक गलती के बजाय टेम्पलेट्स, पेजिनेशन, या फ़ैसेटेड नेविगेशन के ज़रिए चुपचाप आ जाते हैं। यह टूल पूरी निर्यात की गई पेज सूची को एक साथ ऑडिट करता है: कौन-से title और description बिल्कुल डुप्लिकेट हैं या टेम्पलेट के नियर-डुप्लिकेट वेरिएंट, कौन-से गायब हैं, और कौन-से Google के परिणामों में ट्रंकेट होने लायक लंबे हैं — इस तरह का साइट-व्यापी पैटर्न पेजों को एक-एक करके खोलकर पकड़ना लगभग असंभव है।

जाँच कैसे काम करती है

हर पंक्ति की पहले लंबाई और ट्रंकेशन जोखिम के लिए अलग से जाँच की जाती है, फिर डुप्लिकेट खोजने के लिए हर दूसरी पंक्ति से तुलना की जाती है।

एग्ज़ैक्ट और नियर-डुप्लिकेट डिटेक्शन

title और description को एग्ज़ैक्ट डुप्लिकेट के लिए नॉर्मलाइज़्ड टेक्स्ट के रूप में और नियर-डुप्लिकेट के लिए वर्ड सेट (Jaccard/containment ओवरलैप — हमारे Duplicate Content Checker में उपयोग की जाने वाली तकनीक की उसी श्रेणी) के रूप में तुलना किया जाता है, जिससे केवल एक शब्द या संख्या बदले हुए टेम्पलेटेड title भी पकड़ में आ जाते हैं।

SERP पिक्सेल-चौड़ाई ट्रंकेशन

केवल कैरेक्टर काउंट भरोसेमंद नहीं है — संकरे अक्षरों (i, l, t) से भरा title फ़िट हो जाता है, जबकि उसी लंबाई में चौड़े अक्षरों (m, w, M) से भरा title पहले ही कट सकता है। यह टूल मानक Arial ग्लिफ़ मेट्रिक्स का उपयोग करके Google के अनुमानित डेस्कटॉप ट्रंकेशन पॉइंट (title के लिए लगभग 580px, description के लिए 920px) के मुक़ाबले वास्तविक रेंडर की गई पिक्सेल चौड़ाई का अनुमान लगाता है।

गायब टैग डिटेक्शन

खाली title या description वाली पंक्तियों को डुप्लिकेट और लंबाई की समस्याओं से अलग फ़्लैग किया जाता है, क्योंकि खाली टैग का मतलब है कि Google आपकी जगह शब्द चुन रहा है।

डुप्लिकेट URL डिटेक्शन

दो पंक्तियों में एक ही URL का दिखना आमतौर पर डेटा-एंट्री या एक्सपोर्ट की गलती दर्शाता है — इसे फ़्लैग किया जाता है ताकि आप परिणामों पर कार्रवाई करने से पहले सोर्स सूची ठीक कर सकें।

अक्सर पूछे जाने वाले प्रश्न

मुझे किस फ़ॉर्मैट में पेस्ट करना चाहिए?

प्रति पंक्ति एक पेज, फ़ील्ड्स को टैब, पाइप (|), या कॉमा से अलग करें। सबसे आसान स्रोत है स्प्रेडशीट पेस्ट (जो स्वतः टैब का उपयोग करता है) या Screaming Frog जैसे क्रॉलर से CSV एक्सपोर्ट — URL, Title, और Meta Description कॉलम कॉपी करें। हेडर पंक्ति स्वतः पहचानी और स्किप कर दी जाती है।

अगर पेजों की सामग्री अलग है तो डुप्लिकेट title समस्या क्यों है?

सर्च इंजन title टैग का उपयोग यह समझने के लिए करते हैं कि पेज किस बारे में है और यह उपयोगकर्ताओं को परिणामों में से चुनने में मदद करता है। जब कई पेज एक ही title साझा करते हैं, तो यह संकेत देता है कि पेज स्पष्ट रूप से अलग नहीं हैं, और Google उनमें से कुछ के लिए अपनी ओर से अलग title चुन सकता है — जिससे वह शब्दावली बेकार हो जाती है जिसे आप वाकई दिखाना चाहते थे।

क्या नियर-डुप्लिकेट title को हमेशा ठीक करना ज़रूरी है?

हमेशा नहीं — कुछ टेम्पलेटेड title पैटर्न (जैसे "[शहर] मौसम पूर्वानुमान") जान-बूझकर बनाए जाते हैं और तब तक ठीक हैं जब तक हर अद्वितीय एंटिटी नाम वास्तव में अलग है। नियर-डुप्लिकेट फ़्लैग को यह जाँचने की याद दिलाने वाला संकेत मानें कि बदलने वाला हिस्सा वाकई मौजूद और सार्थक है, न कि एक स्वचालित त्रुटि।

क्या यह टूल मेरे पेज लाता है या डेटा कहीं भेजता है?

कोई पेज नहीं लाया जाता। पेस्ट की गई सूची तुलना चलाने के लिए HTTPS के ज़रिए हमारे सर्वर पर एक बार भेजी जाती है (ताकि मैचिंग लॉजिक सर्वर-साइड पर सुसंगत रहे), और अनुरोध पूरा होने के बाद इसे संग्रहीत नहीं किया जाता।