जनरेटिव AI क्या है?
जनरेटिव AI ऐसा कृत्रिम बुद्धि है जो सीखे हुए डेटा जैसी नई सामग्री बनाता है। पुराना AI ज़्यादातर विभेदक (discriminative) है: छाँटता या अनुमान लगाता है (स्पैम या नहीं, बिल्ली या कुत्ता)। जनरेटिव AI नया ईमेल, बिल्ली का नया चित्र या नई धुन बनाता है।
| प्रकार | क्या बनाता है | उपयोग |
|---|---|---|
| टेक्स्ट (बड़े भाषा मॉडल) | उत्तर, निबंध, सारांश, कोड | चैटबॉट, लेखन सहायक |
| चित्र | टेक्स्ट प्रॉम्प्ट से चित्र | पोस्टर, कॉन्सेप्ट आर्ट |
| आवाज़ | बोली, संगीत, ध्वनि | वॉइस-ओवर, पढ़कर सुनाना |
| वीडियो | छोटी क्लिप | एनिमेशन के मसौदे |
यह कैसे काम करता है?
1. बहुत बड़े डेटा पर प्रशिक्षण
लाखों-अरबों बदलने योग्य संख्याओं (पैरामीटर या वेट) वाले न्यूरल नेटवर्क को बहुत सारा डेटा दिखाया जाता है। हर ग़लत अनुमान पर संख्याएँ थोड़ी बदलती हैं। अंत में मॉडल में पैटर्न रहते हैं, नक़लों का पुस्तकालय नहीं।
2. टेक्स्ट: अगले टोकन का अनुमान
बड़ा भाषा मॉडल (LLM) टेक्स्ट को टोकन (शब्द या शब्दांश) में बाँटता है। प्रॉम्प्ट मिलने पर हर संभव अगले टोकन को प्रायिकता देता है, एक चुनता है, जोड़ता है और दोहराता है। तापमान (temperature) चुनाव तय करता है: कम तापमान पर सबसे संभावित शब्द (सुरक्षित, दोहराव); ज़्यादा पर कम संभावित शब्द भी (रचनात्मक, ग़लतियाँ ज़्यादा)।
3. चित्र: डिफ़्यूज़न और GAN
डिफ़्यूज़न मॉडल चित्रों से शोर हटाना सीखता है। बनाते समय शुद्ध शोर से शुरू करके प्रॉम्प्ट के अनुसार चरण-दर-चरण शोर हटाता है। GAN (जनरेटिव एडवर्सेरियल नेटवर्क) में दो भाग हैं: जनरेटर नक़ली बनाता है और डिस्क्रिमिनेटर पकड़ने की कोशिश करता है; मुक़ाबले से दोनों बेहतर होते हैं।
प्रॉम्प्ट
अच्छा प्रॉम्प्ट साफ़ और ख़ास होता है: काम, पढ़ने वाला, रूप और सीमा बताएँ। "10 साल के बच्चे को 3 छोटे वाक्यों में गुरुत्वाकर्षण समझाओ" सिर्फ़ "गुरुत्वाकर्षण" से बेहतर है।
जनरेटिव AI के उपयोग
- पढ़ाई: आसान व्याख्या, अभ्यास प्रश्न, अनुवाद।
- काम: ईमेल और रिपोर्ट के मसौदे, लंबे दस्तावेज़ों का सारांश, कोड लिखना और सुधारना।
- रचनात्मक: विचारों के स्केच, संगीत के मसौदे, स्टोरीबोर्ड।
- सुलभता: टेक्स्ट पढ़कर सुनाना, कम देखने वालों के लिए चित्रों का वर्णन, स्थानीय भाषाओं में आवाज़ से मदद।
- विज्ञान और स्वास्थ्य: नए अणु डिज़ाइन करना, डॉक्टर के जाँचने के लिए नोट्स का मसौदा।
जनरेटिव AI सहायक है, आँख मूँदकर भरोसे वाला विशेषज्ञ नहीं। ज़रूरी फ़ैसले इंसान के हाथ में रहें।
ख़तरे, नैतिकता और ज़िम्मेदार उपयोग
ख़तरे
- हैलुसिनेशन: मॉडल गढ़े हुए तथ्य, कथन या संदर्भ पूरे भरोसे से बता सकता है।
- पक्षपात: प्रशिक्षण डेटा अनुचित हो तो नतीजे भी अनुचित (जैसे इंजीनियर सिर्फ़ पुरुष दिखाना)।
- डीपफ़ेक और ग़लत सूचना: असली लोगों के नक़ली चित्र, आवाज़ और वीडियो।
- निजता: टूल में डाला गया निजी डेटा जमा या लीक हो सकता है।
- कॉपीराइट और श्रेय: प्रशिक्षण में रचनाकारों के काम के उपयोग और नतीजों के मालिक पर प्रश्न।
- नक़ल और ज़्यादा निर्भरता: AI उत्तर नक़ल करने से सीखना रुकता है।
- ऊर्जा: बड़े मॉडल चलाने में बहुत बिजली और पानी लगता है।
ज़िम्मेदार उपयोग (जा-श्रे-ब-भ)
- जाँचो: भरोसेमंद स्रोतों से तथ्य मिलाएँ।
- श्रेय दो: बताएँ कि AI इस्तेमाल किया; स्कूल के नियम मानें; रचनाकारों का सम्मान करें।
- बचाओ: पासवर्ड, पता, फ़ोन नंबर या दूसरों के फ़ोटो कभी न डालें।
- भले रहो: AI से किसी को तंग न करें, नक़ली न बनाएँ, धोखा न दें।
करके देखें: 3D में और घर पर
खुले खेल में प्रॉम्प्ट 1 चुनें, तापमान 0.2 रखें और पाँच बार Generate दबाएँ। फिर 2.0 पर दोबारा। हर बार कितने अलग शब्द मिले?
घर पर: परिवार के साथ "इंसानी भाषा मॉडल" खेलें। एक व्यक्ति वाक्य शुरू करे ("हर सुबह मैं…"); हर कोई बारी-बारी एक शब्द जोड़े। देखें कि आप भी LLM की तरह संभावित शब्द चुनते हैं। फिर सिर्फ़ चौंकाने वाले शब्द जोड़ें: यही ज़्यादा तापमान है!
मुख्य सूत्र और परिभाषाएँ
- जनरेटिव AI: डेटा से पैटर्न सीखो → नई सामग्री बनाओ
- LLM चक्र: प्रॉम्प्ट → अगले टोकन की प्रायिकताएँ → एक चुनो → जोड़ो → दोहराओ
- कम तापमान → सबसे संभावित शब्द; ज़्यादा तापमान → ज़्यादा विविधता
- डिफ़्यूज़न: शोर → थोड़ा शोर हटाओ × कई चरण (प्रॉम्प्ट के अनुसार) → चित्र
- GAN: जनरेटर (बनाता) बनाम डिस्क्रिमिनेटर (जाँचता)
- ज़िम्मेदार उपयोग: जाँचो · श्रेय दो · बचाओ · भले रहो
हल किए गए उदाहरण
1. क्या स्पैम फ़िल्टर जनरेटिव AI है? कविता लिखने वाला चैटबॉट?
स्पैम फ़िल्टर ईमेल को दो समूहों में छाँटता है, इसलिए विभेदक है। कविता लिखने वाला चैटबॉट नया टेक्स्ट बनाता है, इसलिए जनरेटिव AI है।
2. अगले शब्द की प्रायिकताएँ: चाय 0.45, कॉफ़ी 0.40, दूध 0.15। बहुत कम तापमान पर कौन-सा शब्द चुना जाएगा? ज़्यादा पर?
कम तापमान: लगभग हमेशा "चाय"। ज़्यादा तापमान: तीनों में से कोई भी, और "दूध" का मौका पहले से बढ़ जाता है।
3. इस प्रॉम्प्ट को सुधारें: "पानी के बारे में लिखो।"
जैसे: "कक्षा 8 के छात्रों के लिए घर पर पानी बचाने के 5 बिंदु लिखो, हर एक के साथ एक उदाहरण।" इसमें काम, पढ़ने वाले, रूप और लंबाई है।
4. चैटबॉट ने किताब का ऐसा संदर्भ दिया जो कहीं नहीं मिलता। क्या हुआ और क्या करें?
यह हैलुसिनेशन है: मॉडल ने विश्वसनीय लगने वाला पर गढ़ा हुआ संदर्भ बनाया। पुस्तकालय सूची या भरोसेमंद वेबसाइट से जाँचें और बिना पुष्टि के उपयोग न करें।
आम गलतियाँ
- AI की हर बात पर भरोसा करना। यह संभावित शब्द चुनता है, जाँचे हुए तथ्य नहीं।
- सोचना कि मॉडल पूरे दस्तावेज़ जमा करके नक़ल करता है। यह पैटर्न सीखता है, हालाँकि कभी-कभी प्रशिक्षण का टेक्स्ट दोहरा सकता है, जो कॉपीराइट की चिंता है।
- चैटबॉट में निजी जानकारी (पता, फ़ोन, पासवर्ड) डालना।
- AI से लिखा काम बिना अनुमति या श्रेय के अपना बताकर जमा करना।