Search-Engines, Searching the web

सर्च इंजन (Search Engines)

सर्च इंजन एक सॉफ्टवेयर प्रणाली है जो वर्ल्ड वाइड वेब (WWW) पर उपलब्ध अरबों वेब पेजों को व्यवस्थित रूप से सूचीबद्ध (Index) करती है, और उपयोगकर्ता द्वारा क्वेरी (प्रश्न) टाइप करने पर सबसे प्रासंगिक परिणाम प्रदर्शित करती है। यह इंटरनेट की लाइब्रेरी के कैटलॉग (सूची) की तरह कार्य करती है।

बिना सर्च इंजन के किसी विशिष्ट वेबसाइट को ढूंढना बेहद कठिन होगा, क्योंकि हमें सीधा URL पता नहीं पता होता। Google, Bing, Yahoo, DuckDuckGo प्रमुख सर्च इंजन के उदाहरण हैं। सर्च इंजन क्रॉलर (Crawler) नामक स्वचालित रोबोट का उपयोग करते हैं।

सर्च इंजन की कार्यप्रणाली (Working of Search Engine)

सर्च इंजन तीन मुख्य चरणों में कार्य करता है:

(क) क्रॉलिंग (Crawling / Spidering):

सर्च इंजन अपने स्वचालित प्रोग्राम (जिन्हें क्रॉलर, स्पाइडर या बॉट कहा जाता है) को भेजता है, जो वेब पर जाकर एक लिंक से दूसरे लिंक पर कूदते हुए नए- नए वेब पेजों को खोजते हैं। क्रॉलर हर पेज की सामग्री (टेक्स्ट, चित्र, कीवर्ड) पढ़ता है और उसे डाउनलोड कर लेता है।

(ख) इंडेक्सिंग (Indexing):

क्रॉल किए गए सभी पेजों को एक विशाल डेटाबेस (जिसे Index कहते हैं) में संग्रहीत किया जाता है। इंडेक्स एक पुस्तक के अंत में लगने वाले विषय- सूचकांक (Index) की तरह होता है, जहाँ हर कीवर्ड के सामने उससे संबंधित पेजों की सूची होती है। इसी इंडेक्स में सर्च इंजन खोज करता है, न कि लाइव वेब पर।

(ग) रैंकिंग (Ranking):

जब उपयोगकर्ता कोई क्वेरी टाइप करता है, तो सर्च इंजन अपने इंडेक्स में उससे संबंधित पेज ढूंढता है और फिर एल्गोरिदम (विशेष गणितीय सूत्र) का उपयोग करके उन्हें सबसे प्रासंगिक से कम प्रासंगिक के क्रम में व्यवस्थित करता है। सबसे ऊपर आने वाला पेज सबसे अधिक प्रासंगिक माना जाता है। Google का एल्गोरिदम (PageRank) लिंक्स, कीवर्ड, साइट की गुणवत्ता आदि पर आधारित होता है।

प्रमुख सर्च इंजन (Major Search Engines)

सर्च इंजन – विकासकर्ता – विशेषताएँ

Google– Google Inc.- दुनिया का सबसे लोकप्रिय (90%+ मार्केट शेयर), तेज, AI आधारित, PageRank एल्गोरिदम

Bing– Microsoft- Google के बाद दूसरा सबसे बड़ा, Microsoft सेवाओं (Windows, Office) के साथ एकीकृत

Yahoo– Yahoo Inc.- पुराना सर्च इंजन, अब Bing पर चलता है, अपने न्यूज़ और ई-मेल के लिए प्रसिद्ध

DuckDuckGo– – – गोपनीयता पर फोकस करता है, उपयोगकर्ता को ट्रैक नहीं करता, कोई विज्ञापन प्रोफाइलिंग नहीं

Baidu– Baidu Inc.- चीन का सबसे बड़ा सर्च इंजन (चीनी भाषा में विशेषज्ञ)

Yandex– Yandex- रूस का सबसे लोकप्रिय सर्च इंजन

वेब सर्चिंग की अवधारणा (Searching the Web – Concept)

वेब सर्चिंग का अर्थ है सर्च इंजन के माध्यम से इंटरनेट पर वांछित जानकारी, वेबसाइट, चित्र, वीडियो या दस्तावेज़ को खोजना। उपयोगकर्ता सर्च बॉक्स में कीवर्ड (शब्दों या वाक्यांशों) को टाइप करता है और Enter दबाता है, जिसके बाद सर्च इंजन परिणाम (Search Engine Results Page-SERP) प्रदर्शित करता है।

प्रभावी सर्चिंग के लिए सही कीवर्ड का चयन करना, उद्धरण चिह्न (” “) का उपयोग करना, और फिल्टर (तिथि, भाषा, क्षेत्र) का उपयोग करना आवश्यक है। उदाहरण के लिए, “PGDCA notes in Hindi” टाइप करने से केवल वही पेज दिखेंगे जिनमें यह सटीक वाक्यांश हो।

प्रभावी वेब सर्चिंग की तकनीकें (Effective Searching Techniques / Search Operators)

ये वे तरीके हैं जिनसे सर्च अधिक सटीक और त्वरित बनाया जा सकता है:

ऑपरेटर / तकनीक – उपयोग (उदाहरण) – परिणाम

उद्धरण चिह्न (” “)– “परीक्षा की तैयारी”- उसी क्रम में सटीक वाक्यांश वाले पेज ढूँढता है

माइनस साइन (- )– मोबाइल- नोकिया- ‘मोबाइल’ तो दिखाएगा लेकिन ‘नोकिया’ हटा देगा

साइट: (site:)– site:gov.in शिक्षा- केवल gov.in डोमेन पर शिक्षा से संबंधित पेज

फ़ाइल टाइप (filetype:)– रिजल्ट filetype:pdf- केवल PDF फाइलें दिखाएगा

OR (या |)– परीक्षा 2024 OR 2025- दोनों में से किसी एक शब्द वाले परिणाम

तारांकन (*)– वेब * डिजाइनिंग- तारांकन के स्थान पर कोई भी शब्द (जैसे डिज़ाइन, डेवलपमेंट) आ सकता है

तिथि फिल्टर– टूल्स के अंतर्गत- पिछले साल, महीने या सप्ताह की सामग्री

वेब सर्चिंग के लाभ और सीमाएँ (Advantages & Limitations)

लाभ:

(1) कोई भी जानकारी कुछ ही सेकंड में मिल जाती है।

(2) यह पूर्णतः निःशुल्क है (कोई भी उपयोग कर सकता है)।

(3) चित्र, वीडियो, समाचार, मानचित्र, शैक्षिक सामग्री सभी प्रकार के डेटा उपलब्ध हैं।

सीमाएँ:

(1) कभी- कभी गलत या पुरानी जानकारी भी मिल सकती है, इसलिए जाँच आवश्यक है।

(2) सभी वेबसाइटें सर्च इंजन में सूचीबद्ध नहीं होतीं (डीप वेब)।

(3) सर्च इंजन उपयोगकर्ता के सर्च इतिहास को ट्रैक करते हैं (गोपनीयता संबंधी चिंता)।

सारांश तालिका (Quick Summary)

सर्च इंजन– इंटरनेट पर चीज़ें ढूंढने वाला सॉफ्टवेयर (जैसे Google)

क्रॉलर– एक रोबोट जो वेब पेजों को स्कैन करता है

इंडेक्स– सर्च इंजन का डेटाबेस (सूची) जहाँ सारे पेज सेव होते हैं

रैंकिंग– सबसे अच्छे परिणाम को सबसे ऊपर दिखाना

SERP(सर्च इंजन रिजल्ट पेज) – सर्च करने पर दिखने वाला परिणाम पृष्ठ

सर्च ऑपरेटर– सटीक परिणाम के लिए विशेष चिह्न (“- “, site:, filetype:)

परीक्षा टिप्स:

सर्च इंजन के तीन कार्य: क्रॉलिंग → इंडेक्सिंग → रैंकिंग (यह क्रम याद रखें)

Google, Bing, DuckDuckGo नाम लिखना न भूलें

प्रभावी सर्चिंग तकनीकों में उद्धरण चिह्न (” “) और site: का उदाहरण देना अच्छा अंक दिलाता है

SERP (सर्च इंजन रिजल्ट पेज) का संक्षिप्त नाम और अर्थ लिखें

Exam Questions –

1- सर्च इंजन से आपका क्‍या मतलब है इसका उपयोग समझाइए। mcu 2019

2-  सर्च इंजन के विभिन्‍न अनुप्रयोंगों को लिखिए। mcu 2024

3- वेब ब्राउजर क्‍या है वेब ब्राउजर की विभिन्‍न सेवाऍं लिखिए। mcu 2024

error: Content is protected !!