सूचना विज्ञान अभ्यास के पाठ
23 पाठ
- इंटरनेट और वेब: URL, सेवाएँ, वेबसाइट, होस्टिंग और ब्राउज़र – इंटरनेट पूरी दुनिया के नेटवर्कों का नेटवर्क है। वर्ल्ड वाइड वेब उस पर रखे, हाइपरलिंक से जुड़े वेब पेजों का संग्रह है, और हर पेज का पता URL कहलाता है। इंटरनेट पर ईमेल, चैट और VoIP भी चलते हैं। वेबसाइट जुड़े हुए वेब पेजों का समूह है; पेज स्थिर (सबके लिए एक जैसे) या गतिशील (हर आगंतुक के लिए बने) होते हैं। वेब सर्वर पेज रखता और भेजता है, और वेब होस्टिंग साइट को ऑनलाइन रखती है। ब्राउज़र पेज दिखाता है, और उसकी सेटिंग्स, ऐड-ऑन, प्लग-इन और कुकीज़ उसका काम बदलते हैं।
- ई-कचरा और तकनीक का स्वास्थ्य पर प्रभाव – ई-कचरा फेंका गया इलेक्ट्रॉनिक सामान है। इसमें सीसा, पारा और कैडमियम जैसी ज़हरीली धातुएँ होती हैं जो खुले में फेंकने या जलाने पर मिट्टी, पानी, हवा और लोगों को नुकसान पहुँचाती हैं। इसका प्रबंधन कम ख़रीदना, दोबारा उपयोग और अधिकृत रीसाइक्लर से पुनर्चक्रण है, जिसे भारत के ई-कचरा (प्रबंधन) नियम ज़रूरी बनाते हैं। ज़्यादा देर उपकरण चलाने से आँख, मुद्रा, कलाई, नींद और मन पर असर पड़ता है; सही बैठना और ब्रेक हमें स्वस्थ रखते हैं।
- उभरती प्रवृत्तियाँ: AI, IoT, क्लाउड और ब्लॉकचेन – उभरती प्रौद्योगिकियाँ वे नई तकनीकें हैं जो हमारे जीने और काम करने का तरीका बदल रही हैं। AI से मशीन समझदारी वाला काम करती है; मशीन लर्निंग से वह डेटा से सीखती है; NLP से वह इंसानी भाषा समझती है। AR असली दुनिया में आभासी चीज़ जोड़ता है, VR पूरी नई दुनिया दिखाता है। रोबोट महसूस करते, सोचते और काम करते हैं। IoT के सेंसर बिग डेटा बनाते हैं, जिसे स्मार्ट सिटी इस्तेमाल करती है। क्लाउड इंटरनेट से IaaS, PaaS, SaaS किराए पर देता है; ग्रिड कई कंप्यूटर जोड़कर बड़ा काम करता है। ब्लॉकचेन एक साझा रिकॉर्ड है जिसे चुपके से बदलना बहुत मुश्किल है।
- कंपनी की गतिविधियाँ और सूचना प्रसंस्करण – आँकड़े (डेटा) कच्चे तथ्य हैं। सूचना प्रसंस्करण में आँकड़े जमा करते हैं, छाँटते और गिनते हैं और साफ़ दिखाते हैं ताकि लोग फ़ैसला ले सकें। कंपनियाँ इसे बिक्री, खरीद, वेतन और योजना में इस्तेमाल करती हैं। अच्छा संचार साफ़ सूचना डिज़ाइन माँगता है: एक संदेश, सादा चार्ट, ईमानदार लेबल। सूचना नैतिकता का मतलब है जानकारी संभालते समय गोपनीयता, सच, स्वामित्व और अनुमति का सम्मान।
- कंप्यूटर और संगणन: विकास, भाग और इनपुट-आउटपुट उपकरण – कंप्यूटर एक इलेक्ट्रॉनिक मशीन है जो इनपुट लेती है, प्रोग्राम के अनुसार उस पर काम करती है, डेटा सहेजती है और आउटपुट देती है। अबेकस से स्मार्टफ़ोन तक उपकरण बदलते गए। हर कंप्यूटर में इनपुट इकाई, CPU, मेमोरी और आउटपुट इकाई होती है, जो बस और पोर्ट से जुड़ी रहती हैं।
- कंप्यूटर नेटवर्क: प्रकार, उपकरण और टोपोलॉजी – कंप्यूटर नेटवर्क डेटा और साधन बाँटने के लिए जुड़े उपकरणों का समूह है। क्षेत्र के हिसाब से नेटवर्क PAN, LAN, MAN और WAN हैं। उपकरणों के काम अलग हैं: मॉडेम डिजिटल और एनालॉग सिग्नल बदलता है, रिपीटर कमज़ोर सिग्नल मज़बूत करता है, हब डेटा सभी पोर्ट पर भेजता है, स्विच सिर्फ़ सही उपकरण को भेजता है, राउटर नेटवर्क जोड़कर रास्ता चुनता है, और गेटवे अलग प्रोटोकॉल वाले नेटवर्क जोड़ता है। टोपोलॉजी जुड़ाव का ढाँचा है: स्टार, बस, ट्री और मेश, हर एक के अपने गुण-दोष।
- कंप्यूटर मेमोरी: इकाइयाँ, प्राथमिक और द्वितीयक, डेटा रिकवरी – कंप्यूटर सब कुछ बिट (0 या 1) में रखता है। 8 बिट = 1 बाइट, और हर बड़ी इकाई पिछली से 1024 गुना होती है। प्राथमिक मेमोरी (RAM, ROM, कैश) सीधे CPU के साथ काम करती है; द्वितीयक भंडारण (HDD, SSD, पेन ड्राइव) फ़ाइलें लंबे समय तक रखता है। डिलीट की गई फ़ाइल ओवरराइट होने तक अक्सर वापस मिल सकती है, इसलिए डेटा की सुरक्षा ज़रूरी है।
- डिजिटल पदचिह्न, नेट शिष्टाचार, IPR और FOSS – ऑनलाइन हम जो भी करते हैं, उसका निशान रह जाता है — यही डिजिटल पदचिह्न है। अच्छा डिजिटल नागरिक नेट शिष्टाचार मानता है, अपना डेटा बचाता है और दूसरों की बौद्धिक संपदा का सम्मान करता है। बिना श्रेय नकल करना साहित्यिक चोरी है। लाइसेंस बताता है कि सॉफ़्टवेयर कैसे इस्तेमाल करें; FOSS इस्तेमाल, अध्ययन, बदलाव और बाँटने की आज़ादी देता है।
- डेटाबेस संकल्पनाएँ: DBMS, रिलेशन और की – अलग-अलग फ़ाइलों में डेटा रखने से दोहराव, असंगति और कमज़ोर सुरक्षा होती है। डेटाबेस संबंधित डेटा को एक व्यवस्थित जगह रखता है, और DBMS (जैसे MySQL) उसे सँभालने वाला सॉफ़्टवेयर है। रिलेशनल मॉडल में डेटा तालिकाओं (रिलेशन) में रहता है, जिनमें स्तंभ (एट्रिब्यूट) और पंक्तियाँ (टपल) होती हैं; डोमेन किसी स्तंभ के अनुमत मानों का समूह है। कैंडिडेट की हर पंक्ति को अलग पहचानती है; उनमें से एक प्राइमरी की चुनी जाती है और बाकी ऑल्टरनेट की होती हैं।
- पांडास डेटाफ़्रेम: पूरी तालिका के साथ काम – डेटाफ़्रेम पांडास की द्वि-आयामी तालिका है, जिसमें लेबल वाली पंक्तियाँ (इंडेक्स) और लेबल वाले स्तंभ होते हैं। हर स्तंभ एक सीरीज़ है। इसे सीरीज़ की डिक्शनरी, डिक्शनरियों की सूची या CSV फ़ाइल से बनाते हैं। हम इसे दिखा सकते हैं, पंक्ति-दर-पंक्ति या स्तंभ-दर-स्तंभ घूम सकते हैं, पंक्तियाँ-स्तंभ जोड़, चुन, हटा और उनका नाम बदल सकते हैं, loc, iloc या शर्त से डेटा चुन सकते हैं, और CSV में वापस सहेज सकते हैं।
- पांडास सीरीज़: लेबल वाला डेटा का एक स्तंभ – पांडास पायथन की लाइब्रेरी है जो तालिका वाले डेटा के साथ काम करती है, और मैटप्लॉटलिब चार्ट बनाती है। सीरीज़ मानों का एक स्तंभ है, जिसमें हर मान का एक लेबल होता है। इन लेबलों को इंडेक्स कहते हैं। सीरीज़ सूची या NumPy ऐरे से, डिक्शनरी से या एक अकेले मान से बनती है। दो सीरीज़ का गणित लेबल मिलाकर होता है; जिस लेबल का जोड़ीदार न हो वहाँ NaN आता है। head() और tail() शुरू या आख़िर के मान दिखाते हैं, और मान लेबल, स्थान, स्लाइस या शर्त से चुने जाते हैं।
- पायथन की मूल बातें: मोड, वेरिएबल, डेटा प्रकार और ऑपरेटर – पायथन इंटरैक्टिव मोड (एक-एक पंक्ति) या स्क्रिप्ट मोड (सहेजी गई .py फ़ाइल) में चलता है। ब्लॉक इंडेंटेशन से पहचाने जाते हैं। वेरिएबल मान से बँधे नाम हैं; हर मान का एक डेटा प्रकार होता है, और कुछ प्रकार परिवर्तनशील हैं। ऑपरेटर व्यंजक बनाते हैं जिन्हें पायथन प्राथमिकता के क्रम से हल करता है। input() टेक्स्ट पढ़ता है, int()/float()/str() प्रकार बदलते हैं, और डिबगिंग से सिंटैक्स, रनटाइम और तार्किक त्रुटियाँ ठीक होती हैं।
- पायथन में डिक्शनरी: कुंजी-मान जोड़े और मेथड – डिक्शनरी घुँघराले कोष्ठक में कुंजी: मान जोड़ों का परिवर्तनशील संग्रह है, जैसे {"Ravi": 85}। कुंजियाँ अद्वितीय और अपरिवर्तनशील होती हैं; मान कुछ भी हो सकता है। d[key] = value से जोड़ा जोड़ते या बदलते हैं, d[key] या d.get(key) से पढ़ते हैं, for k in d से ट्रैवर्स करते हैं, और keys(), values(), items(), update(), pop(), popitem(), clear() जैसे मेथड इस्तेमाल करते हैं।
- पायथन में नियंत्रण कथन: if-else, while और for – सामान्यतः पायथन पंक्तियाँ एक के बाद एक चलाता है (क्रम)। नियंत्रण कथन यह बहाव बदलते हैं। if-else दो में से एक रास्ता चुनता है; if-elif-else कई में से पहली सच्ची शर्त चुनता है। while शर्त सच रहने तक ब्लॉक दोहराता है; for किसी क्रम, जैसे range(start, stop, step), के हर आइटम के लिए एक बार चलता है।
- पायथन में list: बनाना, ट्रैवर्स, बदलना और list मेथड – list वर्ग कोष्ठक में लिखा क्रमबद्ध, बदलने योग्य संग्रह है, जैसे [10, 20, 30]। आइटम इंडेक्स (0 से, या अंत से ऋणात्मक) और स्लाइस से मिलते हैं। for लूप से list ट्रैवर्स करते हैं, list परिवर्तनशील है इसलिए आइटम वहीं बदलते हैं, और फ़ंक्शन (len, max, min, sum, sorted, list) व मेथड (append, insert, extend, remove, pop, sort, reverse, count, index, clear) से काम करते हैं।
- मैटप्लॉटलिब से डेटा दृश्यीकरण: रेखा, बार और हिस्टोग्राम – डेटा दृश्यीकरण का अर्थ है डेटा को चार्ट जैसे चित्रों में दिखाना, ताकि पैटर्न आसानी से दिखें। पायथन में हम मैटप्लॉटलिब का pyplot मॉड्यूल plt नाम से लाते हैं। रेखा प्लॉट समय के साथ बदलाव दिखाता है, बार ग्राफ़ अलग समूहों की तुलना करता है और हिस्टोग्राम दिखाता है कि मान दायरों (बिन) में कैसे फैले हैं। शीर्षक, अक्ष लेबल और लेजेंड चार्ट को साफ़ बनाते हैं, और plt.savefig() उसे चित्र फ़ाइल में सहेजता है।
- व्यावसायिक सूचना अभ्यास: आँकड़ों को निर्णय में बदलें – व्यावसायिक सूचना अभ्यास का मतलब है व्यवसाय चलाने में आँकड़ों का उपयोग करना। आँकड़े (डेटा) कच्चे तथ्य और संख्याएँ हैं, जैसे हर दिन बिके कप। सूचना वे आँकड़े हैं जिन्हें क्रम में रखकर और संसाधित करके निर्णय में उपयोगी बनाया गया हो। अभ्यास के पाँच कदम हैं: आँकड़े जुटाओ, तालिका या स्प्रेडशीट में सजाओ, गणना करो (योग, औसत, सबसे बड़ा और सबसे छोटा), चार्ट में दिखाओ, और निर्णय लो। जूस-स्टॉल प्रोजेक्ट में आम सोमवार से शुक्रवार 12, 18, 15, 20 और 25 कप बिकता है। योग 90, औसत 18 और सबसे अच्छा दिन 25। नींबू 10, 9, 11, 8 और 12 बिकता है, औसत 10। चार्ट में आम बढ़ता दिखता है, इसलिए मालिक आम ज़्यादा बनाने का निर्णय लेता है। अच्छी सूचना के लिए सही आँकड़े चाहिए, और ग्राहकों के विवरण जैसे व्यावसायिक डेटा को मज़बूत पासवर्ड और बैकअप से सुरक्षित रखना चाहिए।
- साइबर अपराध और भारत का IT अधिनियम – साइबर अपराध वह अपराध है जिसमें कंप्यूटर, फ़ोन या इंटरनेट का इस्तेमाल होता है। मुख्य हैं हैकिंग, फ़िशिंग, साइबर बुलिंग, पहचान की चोरी और रैनसमवेयर। भारत का सूचना प्रौद्योगिकी अधिनियम, 2000 (2008 में संशोधित) इनके लिए सज़ा तय करता है। शिकायत cybercrime.gov.in पर या 1930 पर करें।
- सॉफ़्टवेयर: सिस्टम और एप्लिकेशन, सामान्य और विशिष्ट – सॉफ़्टवेयर प्रोग्रामों का समूह है। सिस्टम सॉफ़्टवेयर (ऑपरेटिंग सिस्टम, डिवाइस ड्राइवर, यूटिलिटी, भाषा अनुवादक) कंप्यूटर को चलाता और सँभालता है। एप्लिकेशन सॉफ़्टवेयर उपयोगकर्ता का काम करता है। एप्लिकेशन सॉफ़्टवेयर सामान्य उद्देश्य (बहुत लोगों के लिए तैयार) या विशिष्ट उद्देश्य (एक संस्था के लिए बनवाया) हो सकता है।
- MySQL के साथ SQL: तालिका बनाना, पंक्तियाँ बदलना और सवाल पूछना – SQL (स्ट्रक्चर्ड क्वेरी लैंग्वेज) MySQL जैसे रिलेशनल DBMS से बात करने की भाषा है। DDL कमांड (CREATE, ALTER, DROP) तालिकाएँ परिभाषित करते हैं; DML कमांड (INSERT, UPDATE, DELETE) पंक्तियाँ बदलते हैं; DQL (SELECT) डेटा पढ़ता है। हर स्तंभ का डेटा प्रकार होता है, जैसे INT, FLOAT, CHAR, VARCHAR या DATE। SELECT … WHERE संबंधात्मक ऑपरेटर, BETWEEN, AND/OR/NOT और IS NULL से पंक्तियाँ छाँटता है।
- NumPy का परिचय: list से array बनाना – NumPy (न्यूमेरिकल पायथन) array पर तेज़ गणित की लाइब्रेरी है। array ऐसे आइटमों का ग्रिड है जिनका प्रकार एक ही हो। np.array(list) से list को array बनाते हैं; list की list से 2-D array बनता है। ndim, shape, size और dtype इसका वर्णन करते हैं। list के उलट, array हर आइटम पर एक साथ गणित करता है।
- SQL समुच्चय फ़ंक्शन, GROUP BY, HAVING, ORDER BY और इक्वी-जॉइन – समुच्चय (मल्टी-रो) फ़ंक्शन कई पंक्तियाँ लेकर एक मान लौटाते हैं: MAX, MIN, SUM, AVG और COUNT। ये NULL मान छोड़ देते हैं, सिवाय COUNT(*) के, जो हर पंक्ति गिनता है। GROUP BY एक जैसे मान वाली पंक्तियों के समूह बनाता है, ताकि फ़ंक्शन हर समूह पर एक बार चले। HAVING समूहों को छाँटता है, जबकि WHERE समूह बनने से पहले अकेली पंक्तियाँ छाँटता है। ORDER BY परिणाम को बढ़ते या घटते क्रम में लगाता है। इक्वी-जॉइन दो तालिकाओं को वहाँ जोड़ता है जहाँ साझा स्तंभ बराबर हो।
- SQL सिंगल-रो फ़ंक्शन: गणित, टेक्स्ट और तारीख़ – सिंगल-रो फ़ंक्शन किसी पंक्ति का एक मान लेकर एक मान लौटाता है, इसलिए n पंक्तियों वाले स्तंभ पर n उत्तर मिलते हैं। गणितीय फ़ंक्शन: POWER, ROUND और MOD। टेक्स्ट (स्ट्रिंग) फ़ंक्शन: UPPER, LOWER, LENGTH, LEFT, RIGHT, SUBSTR, INSTR और TRIM। तारीख़ फ़ंक्शन: NOW, DATE, MONTH, MONTHNAME, YEAR, DAY और DAYNAME। इन्हें SELECT, WHERE और ORDER BY में लगाते हैं।