AI शब्दों का मतलब: शुरुआती लोगों के लिए आसान शब्दावली

बिना शब्दजाल के काम आने वाली AI शब्दावली: मॉडल, प्रॉम्प्ट, टोकन, कॉन्टेक्स्ट विंडो, LLM, हैलुसिनेशन, और एक ईमानदार बात कि कौन से शब्द आप फिलहाल छोड़ सकते हैं।

पहले घंटे में जो पांच शब्द मायने रखते हैं

AI पर लिखी ज़्यादातर चीज़ें एक ऐसी शब्दावली मान लेती हैं जो आपको किसी ने कभी सिखाई ही नहीं। काम का हिस्सा छोटा है। लगभग पूरा व्यावहारिक बोझ पांच शब्द उठाते हैं, और बाकी महीनों तक इंतज़ार कर सकता है।

मॉडल खुद AI है: वह प्रशिक्षित सिस्टम जो आपके शब्द पढ़ता है और जवाब बनाता है। ऐप मॉडल नहीं है। ChatGPT एक ऐप है जो OpenAI के मॉडल चलाता है, Gemini एक ऐप है जो Google के मॉडल चलाता है, और Whizi एक ऐसा ऐप है जो कई कंपनियों के मॉडल एक साथ रखता है। यह फर्क पहली बार तब काम आता है जब कोई जवाब आपको निराश करता है, क्योंकि सवाल के शब्द बदलने से बड़ा लीवर आमतौर पर मॉडल बदलना होता है।

प्रॉम्प्ट बस वही है जो आप टाइप करते हैं। कोई गुप्त सिंटैक्स नहीं, कोई कमांड की सूची नहीं, याद करने को कुछ नहीं। एक सीधा अनुरोध जो बताए कि नतीजा किसके लिए है, उसे क्या काम करना है, और आप उसे किस रूप में चाहते हैं, किसी चालाक एक-लाइनर से लगभग हर बार बेहतर निकलेगा।

चैटबॉट वह बातचीत की खिड़की है जिसमें आप टाइप करते हैं। एक ही बातचीत में आपने जो कुछ कहा है वह जवाब लिखते समय मॉडल की नज़र में रहता है, इसीलिए "इसे छोटा करो" या "थोड़ा औपचारिक करो" जैसे आगे के सवाल बिना मूल अनुरोध दोहराए काम कर जाते हैं। नई चैट खोलें और वह साझा याद खत्म हो जाती है, जो कि विषय बदलने पर आप चाहते ही हैं: किसी असंबंधित सवाल का बचा हुआ संदर्भ उन जवाबों की आम वजह है जो थोड़े बेमेल लगते हैं।

टोकन टेक्स्ट का एक टुकड़ा है, अंग्रेज़ी के औसत शब्द का करीब तीन-चौथाई। मॉडल शब्दों में नहीं, टोकन में पढ़ते, गिनते और बिल बनाते हैं, इसलिए 1,000 शब्दों का दस्तावेज़ कहीं 1,300 टोकन के आसपास बैठता है। यह शब्द आपको ज़्यादातर कीमत वाले पन्नों और इस्तेमाल की सीमाओं में मिलेगा।

कॉन्टेक्स्ट विंडो यह है कि कोई मॉडल एक बार में कितना टेक्स्ट अपनी नज़र में रख सकता है, और इसे टोकन में नापा जाता है। इसमें वह दस्तावेज़ भी आना है जो आपने पेस्ट किया, अब तक की पूरी बातचीत भी, और वह जवाब भी जो लिखा जा रहा है। जब आप पचास पन्नों का कॉन्ट्रैक्ट चैट में डालते हैं और जवाब चुपचाप तीसरे पन्ने का उलटा कहने लगते हैं, तो आप उसी किनारे पर पहुंच गए हैं। कॉन्टेक्स्ट विंडो क्या है में असली आंकड़े हैं; काम का नियम छोटा है। एक विषय पर एक लंबी बातचीत, उसके बाद नई शुरुआत।

अभी करने लायक एक चीज़: कोई भी AI ऐप खोलें और अपने शब्दों में उससे कोई ऐसा शब्द समझाने को कहें जो इस हफ़्ते आपको दिखा और समझ नहीं आया। फिर दूसरा सवाल पूछें, "तुमने क्या मान लिया कि मुझे पहले से पता है?" यह अगला सवाल एक परिभाषा को व्याख्या में बदल देता है, और यह हर विषय पर काम करता है।

हालांकि जवाब को कहीं और से मिलाकर ज़रूर देखें। ये सिस्टम गलत बातें ठीक उसी शांत आवाज़ में कहते हैं जिसमें सही बातें कहते हैं, और परिभाषाएं आसान शिकार हैं: एक भरोसेमंद लगता गढ़ा हुआ ब्योरा आपके सामने से फिसल जाता है क्योंकि उसे पकड़ने का आपके पास कोई तरीका ही नहीं था। इस चूक का एक नाम है, और वह नीचे दी टेबल में है।

बाकी शब्दावली, और क्या वह अभी आपके काम की है

ये वे शब्द हैं जो सुर्खियों, कीमत वाले पन्नों और कमेंट सेक्शन में आपका इंतज़ार कर रहे हैं। तीसरा कॉलम ईमानदारी वाला हिस्सा है। इसमें से ज़्यादातर पहले दिन की जानकारी नहीं है, और उल्टा दिखावा करने से ही शुरुआती लोग ऐसी चीज़ को लेकर खुद को बेवकूफ़ महसूस करने लगते हैं जिससे उनका कोई वास्ता ही नहीं।

शब्दआसान मतलबक्या यह अभी चाहिए?
LLMलार्ज लैंग्वेज मॉडल, वही किस्म जो हर मशहूर चैट ऐप के पीछे है। लेख में LLM लिखा हो तो उसे AI पढ़ लेंहां, ताकि सुर्खियां शोर न लगें
जनरेटिव AIऐसी हर AI जो पहले से मौजूद चीज़ें छांटने के बजाय नया टेक्स्ट, इमेज, ऑडियो या वीडियो बनाती हैहां, एक वाक्य काफ़ी है
प्रशिक्षणवह लंबी, महंगी प्रक्रिया जिसमें मॉडल को भारी मात्रा में टेक्स्ट पढ़ाकर पैटर्न सिखाए जाते हैं। आपके ऐप खोलने से पहले खत्म हो चुकीहां, बस मोटे तौर पर
प्रशिक्षण कट-ऑफवह तारीख जहां प्रशिक्षण डेटा रुक जाता है। उसके बाद की कोई बात पूछें तो मॉडल अंदाज़ा लगाता है, बशर्ते ऐप वेब न खोजेहां, यही लोगों को धोखा देता है
हैलुसिनेशनआत्मविश्वास भरा, रवां और पूरी तरह गढ़ा हुआ जवाब। सबसे मायने रखने वाली खामीहां, पहले ही दिन
मल्टीमॉडलमॉडल सिर्फ़ टेक्स्ट नहीं संभालता: फ़ोटो, PDF, ऑडियो, कभी-कभी वीडियो भीहां, जिस पल आपको कोई तस्वीर अपलोड करनी हो
फाइन-ट्यूनिंगकिसी मौजूदा मॉडल को आपके अपने डेटा पर दोबारा प्रशिक्षित करना ताकि वह किसी काम में माहिर हो जाएअभी नहीं, यह कंपनियों वाला काम है
टेम्परेचरएक डायल जो तय करता है कि शब्द कितने बेतरतीब होंगे। कम मतलब अनुमानित, ज़्यादा मतलब खुलाअभी नहीं, समझदार डिफ़ॉल्ट पहले से चुने हैं
एजेंटऐसी AI जो एक बार जवाब देने के बजाय खुद कई कदम उठाती हैअभी नहीं, और अगला हिस्सा देखें
APIवह जोड़-तोड़ जिससे डेवलपर मॉडल को अपने सॉफ्टवेयर से जोड़ते हैंअभी नहीं, जब तक आप कोड न लिखते हों
RAGरिट्रीवल ऑगमेंटेड जनरेशन: मॉडल जवाब देने से पहले दस्तावेज़ों के भंडार में चीज़ें ढूंढता हैअभी नहीं, हालांकि आपकी फ़ाइलों से जवाब देने वाला हर ऐप इसी पर चलता है
ओपन सोर्स मॉडलऐसा मॉडल जिसके वेट कोई भी डाउनलोड करके चला सकता है, जैसे Llama या DeepSeekअभी नहीं, चैट करने वालों के लिए इससे कम फर्क पड़ता है
रीज़निंग मॉडलऐसा मॉडल जो जवाब देने से पहले दिखते कदमों में समस्या हल करता है। धीमा, पर गणित और तर्क में बेहतरजल्द ही, जब पहली बार कोई मुश्किल सवाल बिगड़े
सिस्टम प्रॉम्प्टवे छिपे निर्देश जो ऐप आपके टाइप करने से पहले ही मॉडल को देता हैअभी नहीं, अपना सहायक बनाते समय काम आता है

दो पंक्तियों पर एक टिप्पणी बनती है। हैलुसिनेशन कोई कभी-कभार की खराबी नहीं है जिसे पैच करके हटा दिया जाए; यह इसी बात से निकलता है कि ये सिस्टम टेक्स्ट कैसे बनाते हैं, इसीलिए AI गलत जवाब क्यों देता है एक बुलेट पॉइंट नहीं, अपनी अलग गाइड है। और मल्टीमॉडल पर दस मिनट देना उसी दिन से ठीक है जिस दिन आपके पास किसी रसीद की फ़ोटो, किसी एरर मैसेज का स्क्रीनशॉट या कोई स्कैन किया फ़ॉर्म आ जाए। इमेज और दस्तावेज़ों के साथ काम करना दिखाता है कि किसी आम मंगलवार को यह कैसा दिखता है।

मार्केटिंग के वे शब्द जो सुनने में जितने बड़े लगते हैं, उतने हैं नहीं

कंपनियां ठीक-ठीक झूठ नहीं बोल रहीं। वे ऐसे शब्द इस्तेमाल कर रही हैं जिनका कभी कोई खास मतलब था और अब ज़्यादातर मतलब है "हमने कुछ लॉन्च किया है"। इस फ़ासले को पहचानना ही आपको रटे-रटाए जवाबों के एक ड्रॉपडाउन के लिए अपग्रेड फीस देने से बचाता है।

  • AI से चलने वाला। आमतौर पर इसका मतलब है कि कोई एक फ़ीचर किसी और की बनाई मॉडल को कॉल करता है। कभी-कभी मतलब होता है एक सुझाव बॉक्स जिसे आप बंद कर सकते हैं। पूछने लायक: कौन सा मॉडल, और क्या यह डिफ़ॉल्ट रूप से चालू है?
  • स्मार्ट। यह शब्द इस पूरी लहर से पुराना है और अब इसका बहुत कम मतलब है। स्मार्ट फ़ोल्डर एक सेव की हुई सर्च है। स्मार्ट रिप्लाई तीन रटे-रटाए वाक्यांश हैं। विशेषण से आगे जाकर क्रिया ढूंढें: यह आपके काम के साथ करता क्या है?
  • नेक्स्ट-जेनरेशन। यह भविष्य काल में किया गया दावा है। यह इस बात के साथ पूरी तरह मेल खाता है कि प्रोडक्ट उस संस्करण से खराब हो जिसकी जगह उसने ली, और यह आमतौर पर तब आता है जब कोई ऐसा सुधार बचा ही न हो जिसे नापकर बताया जा सके।
  • AI एजेंट। 2026 का सबसे मेहनती वाक्यांश। सख्त मायनों में इसका मतलब है ऐसा सॉफ्टवेयर जो खुद योजना बनाकर कई कदम पूरे करे, जैसे पूरी यात्रा की बुकिंग शुरू से आखिर तक। मार्केटिंग में इसका मतलब आमतौर पर एक ज़्यादा दोस्ताना अवतार वाला चैटबॉट होता है। पूछें कि अटक जाने पर वह क्या करता है, और क्या वह आपसे पूछे बिना कुछ कर सकता है।
  • AI-फर्स्ट। यह अंदरूनी रणनीति का बयान है, प्रोडक्ट के साथ आपके अनुभव का नहीं। यह बताता है कि कंपनी अपना इंजीनियरिंग बजट कहां लगाती है, और हो सकता है वह अभी उस फ़ीचर तक पहुंचा ही न हो जिसके लिए आप पैसे देने वाले थे।

एक सवाल इन सबको चीर देता है: पूछें कि गलत होने पर यह फ़ीचर क्या करता है। जिन प्रोडक्ट के अंदर असली AI है, उनके पास इसका जवाब होता है, और उसमें समीक्षा के कदम, एक अनडू, भरोसे का कोई संकेत या दिखता हुआ स्रोत शामिल होता है। सिर्फ़ स्टिकर चिपकाए प्रोडक्ट चुप हो जाते हैं।

मॉडलों के नाम गाड़ी की नंबर प्लेट जैसे क्यों लगते हैं

मॉडल के नाम में दो हिस्से होते हैं जो दो अलग काम करते हैं। शब्द परिवार है, यानी वह प्रोडक्ट लाइन जिसे कंपनी लगातार आगे बढ़ाती है: OpenAI से GPT, Anthropic से Claude, Google से Gemini, Meta से Llama। नंबर और पूंछ में लगे शब्द संस्करण हैं, और अक्सर आकार भी, इसलिए एक ही परिवार एक ही सुबह एक छोटा तेज़ सदस्य और एक बड़ा सावधान सदस्य लॉन्च कर देता है। नाम पढ़ना ज़्यादातर इन दो हिस्सों को अलग करने और बीच की मार्केटिंग को अनदेखा करने का मामला है।

आपने शायद गौर किया हो कि इस लेख में एक भी संस्करण नंबर नहीं लिखा गया। यह जानबूझकर है। संस्करण हर कुछ हफ़्तों में बदलते हैं, और जो भी शब्दावली उन्हें पकड़कर बैठती है वह अगले मौसम तक गलत हो चुकी होती है। जो नहीं बदलता वह है चुनाव का ढांचा। छोटे मॉडल तेज़ और सस्ते हैं और किसी ईमेल को सुधारने के लिए बिल्कुल ठीक हैं। बड़े मॉडल धीमे हैं और लंबे दस्तावेज़ों तथा कठिन तर्क में बेहतर। हर परिवार का अपना मिजाज़ भी होता है जो उसके लहज़े में और इसमें दिखता है कि वह आपके दिए स्रोत से कितनी सख्ती से चिपका रहता है।

सबसे नया रिलीज़ भी अपने आप आपके काम के लिए सही नहीं हो जाता। नया होने का मतलब आमतौर पर बेहतर बेंचमार्क स्कोर है, और बेंचमार्क इम्तिहान जैसी समस्याएं नापते हैं, यह नहीं कि लिखा हुआ आपकी अपनी आवाज़ जैसा लगता है या नहीं। बहुत से लोग पाते हैं कि कोई पुराना, सस्ता मॉडल उनके ईमेल बेहतर लिखता है, और वे महंगे मॉडल को हफ़्ते के दो मुश्किल कामों के लिए बचाकर रखते हैं। यह आप तभी सीखते हैं जब वही असली काम दो या तीन मॉडलों से करवाकर नतीजों को साथ-साथ रखकर पढ़ते हैं, और AI मॉडल कैसे चुनें यही कदम दर कदम बताती है। तीन प्रदाताओं को पैसे दिए बिना यह कर पाना ही वह पूरी वजह है जिसके लिए Whizi, GPT, Claude, Gemini और इमेज मॉडल को एक ही सदस्यता में रखता है।

तीन महीने पूरे होने पर सीखने लायक पांच शब्द

तीसरे महीने तक आप कुछ दीवारों से टकरा चुके होंगे। ये पांच शब्द उन्हीं दीवारों के नाम हैं, इसीलिए इन्हें तब सीखना बनता है, अभी नहीं।

  1. रीज़निंग मॉडल। पहली बार तब मायने रखने लगता है जब कोई मॉडल पूरे आत्मविश्वास से कई कदमों वाली गणना या कोई तर्क पहेली बिगाड़ देता है। रीज़निंग मॉडल पर जाना अक्सर इसे सीधे ठीक कर देता है, बदले में जवाब के लिए ज़्यादा इंतज़ार करना पड़ता है।
  2. सिस्टम प्रॉम्प्ट। तब मायने रखता है जब आपको लगे कि आप हर नई चैट में वही पृष्ठभूमि वाला पैराग्राफ़ पेस्ट कर रहे हैं। उसे एक बार स्थायी निर्देश की तरह सेव कर देना ही इसका हल है।
  3. RAG। तब मायने रखता है जब आप चाहते हैं कि जवाब खुली इंटरनेट के बजाय आपकी अपनी फ़ाइलों पर टिकें, जैसे नीतियों का वह फ़ोल्डर जिसे 2019 के बाद किसी ने पढ़ा ही नहीं।
  4. टेम्परेचर। तब मायने रखता है जब नतीजे या तो हर बार एक जैसे लगने लगें या बहुत बेतरतीब, और आप बार-बार दोबारा चलाने के बजाय एक डायल घुमाना पसंद करें।
  5. फाइन-ट्यूनिंग। किसी अकेले व्यक्ति के लिए यह लगभग कभी मायने नहीं रखता, और यह जानना काम का है कि क्यों: इसमें असली पैसा लगता है, सैकड़ों साफ़ उदाहरण चाहिए, और लोग जिन कामों के लिए इसे सोचते हैं उनमें से लगभग हर काम में एक अच्छे मॉडल पर एक अच्छा प्रॉम्प्ट इससे बेहतर निकलता है।

अगर आप इस सबके नीचे की परत देखना चाहते हैं, तो AI असल में है क्या बिना गणित के इसकी बनावट समझाता है, और AI से बात कैसे करें पहले हिस्से वाले उस प्रॉम्प्ट पैराग्राफ़ को एक आदत में बदल देता है। इस पन्ने को एक हफ़्ते तक किसी टैब में खुला छोड़ दें। जिस शब्द को आप पहले से जानते हैं, उससे चौथी बार टकराने के आसपास यह शब्दावली डराना बंद कर देती है।

चेकलिस्ट
  • बाकी सब से पहले मॉडल, प्रॉम्प्ट, चैटबॉट, टोकन और कॉन्टेक्स्ट विंडो सीख लें।
  • निराश करने वाले जवाब को सिर्फ़ शब्द बदलने की नहीं, मॉडल बदलने की वजह मानें।
  • हर प्रॉम्प्ट को एक पाठक, एक काम और मनचाहा फ़ॉर्मेट दें।
  • जब लंबी बातचीत अपनी ही बात काटने लगे, तो नई चैट शुरू करें।
  • जो परिभाषा या तथ्य आप किसी और को दोहराने वाले हैं, उसे पहले जांच लें।
  • किसी भी कंपनी से पूछें कि उसका AI फ़ीचर कौन सा मॉडल चलाता है और गलत होने पर क्या होता है।
  • किस मॉडल पर भरोसा करना है, यह तय करने से पहले वही असली काम दो मॉडलों पर आज़माएं।

अक्सर पूछे जाने वाले सवाल

LLM का मतलब क्या है?

LLM का मतलब है लार्ज लैंग्वेज मॉडल, यानी वह किस्म की AI जो ChatGPT, Claude, Gemini और हर उस चैट ऐप के पीछे है जिसका नाम आपने सुना है। यह एक ऐसा सिस्टम है जिसे भारी मात्रा में टेक्स्ट पर प्रशिक्षित किया गया है और जो आपकी भाषा के जवाब में काम की भाषा की भविष्यवाणी करता है। किसी लेख में LLM लिखा हो तो आप उसे AI पढ़ सकते हैं, कुछ नहीं छूटेगा।

मॉडल और ChatGPT जैसे ऐप में क्या फर्क है?

मॉडल वह प्रशिक्षित सिस्टम है जो जवाब बनाता है। ऐप उसके चारों ओर का इंटरफ़ेस है, जिसमें चैट विंडो, फ़ाइल अपलोड, इतिहास और बिलिंग होती है। एक ऐप कई मॉडल दे सकता है, इसीलिए एक ही ऐप के अंदर मॉडल बदलने से आपके नतीजे अक्सर ऐप बदलने से ज़्यादा बदलते हैं।

क्या मुझे सचमुच टोकन और कॉन्टेक्स्ट विंडो समझने की ज़रूरत है?

आपको हर एक के बारे में एक वाक्य चाहिए, कोई पढ़ाई नहीं। टोकन एक शब्द का करीब तीन-चौथाई होता है और इसी से इस्तेमाल नापा और बिल किया जाता है। कॉन्टेक्स्ट विंडो यह है कि मॉडल एक बार में कितना टेक्स्ट नज़र में रख सकता है, और इसी से समझ आता है कि बहुत लंबी चैट में वह शुरुआत की बातें क्यों भूलने लगता है।

जब लोग कहते हैं कि AI हैलुसिनेट करता है, तो इसका क्या मतलब है?

मतलब यह कि मॉडल ने कुछ रवां, आत्मविश्वास भरा और झूठा बना दिया: ऐसा हवाला जो मौजूद ही नहीं, बिना स्रोत का आंकड़ा, कोई ऐसी सुविधा जो प्रोडक्ट में कभी थी ही नहीं। ऐसा इसलिए होता है क्योंकि ये सिस्टम सत्यापित तथ्य ढूंढने के बजाय भरोसेमंद लगती भाषा बनाते हैं। नामों, आंकड़ों, तारीखों और उद्धरणों को तब तक बिना जांचा मानें जब तक आप उन्हें जांच न लें।

जब मॉडलों के नाम हर महीने बदलते हैं तो साथ कैसे चलूं?

आपको चलना ही नहीं है। परिवारों को सीख लें, वे स्थिर हैं, और संस्करण नंबरों को ऐसे ब्योरे मानें जिन्हें चुनते समय देख लिया जाता है, न कि ऐसे तथ्य जिन्हें रटा जाए। नया संस्करण आने पर सिर्फ़ एक सवाल मायने रखता है, कि क्या वह आपका खास काम बेहतर करता है, और इसका जवाब आप वह काम चलाकर पाते हैं, घोषणा पढ़कर नहीं।