← ब्लॉग

JavaScript वाली साइट पर क्रॉलर क्या पढ़ सकता है?

ब्राउज़र में पूरा पेज दिखाई दे सकता है, जबकि सर्वर से पहली बार मिले HTML में लगभग कोई सामग्री न हो। ऐसे पेज पर JavaScript बाद में टेक्स्ट और दूसरे हिस्से जोड़ता है। इसका मतलब यह नहीं कि खोज इंजन साइट को पढ़ ही नहीं सकता: Google JavaScript चला सकता है, लेकिन हर क्रॉलर की क्षमता एक जैसी नहीं होती।

ब्राउज़र में दिख रहे पेज को सर्वर के HTML से मिलाएँ

पहले तय करें कि पेज की कौन-सी जानकारी ग्राहक के लिए ज़रूरी है: शीर्षक, सेवा का विवरण, कीमत की शर्तें, सेवा का इलाका और लिंक। डेवलपर से जाँच करवाएँ कि यह जानकारी सर्वर के HTML में मौजूद है या बाद में जुड़ती है। HTML को इस तरह सहेजा जा सकता है:

curl -L https://example.com/service/ -o page.html

सहेजे गए HTML में वास्तविक टेक्स्ट खोजें; केवल स्क्रिप्ट का नाम मिलना पर्याप्त नहीं है। सर्वर का स्टेटस कोड और रीडायरेक्ट भी देखें। 403 का मतलब पहुँच रोकी गई और 429 का मतलब अनुरोधों की सीमा पार हुई हो सकती है। ये उस स्थिति से अलग समस्याएँ हैं जिसमें सर्वर 200 लौटाता है, लेकिन सामग्री पढ़ने के लिए JavaScript चलाना पड़ता है। परीक्षण में User-Agent बदलने से अनुरोध असली क्रॉलर का नहीं हो जाता।

ज़रूरत के हिसाब से सुधारें

स्टैटिक जनरेशन या सर्वर पर रेंडरिंग से सार्वजनिक मुख्य टेक्स्ट तुरंत मिल सकता है। फ़ॉर्म और कैलकुलेटर JavaScript इस्तेमाल करते रह सकते हैं। पूरी साइट दोबारा बनाना हमेशा ज़रूरी नहीं।

सुधार के बाद सर्वर के HTML और ब्राउज़र के पेज को फिर से मिलाएँ। टेक्स्ट, अंदरूनी लिंक और मुख्य पेज का पता बताने वाला canonical URL जाँचें। संबंधित खोज इंजन के पेज जाँचने वाले टूल और सर्वर लॉग भी देखें। इससे पता चलेगा कि जाँच के समय पेज पढ़ा जा सकता था या नहीं; भविष्य के AI जवाब में उसका लिंक आने की गारंटी नहीं मिलेगी।

स्रोत और आगे की जानकारी

संबंधित गाइड

संबंधित गाइड

प्रकाशित: · geo-rank.ai संपादकीय टीम द्वारा जाँचा गया · हम कैसे जाँचते हैं