Llama 3 है क्या
Llama, AI मॉडलों का एक परिवार है जिसे Meta ने बनाया है, वही कंपनी जो Facebook और Instagram के पीछे है। ChatGPT और Claude की तरह, आप सवाल टाइप करते हैं और यह जवाब देता है। दिलचस्प बात यह नहीं है कि यह करता क्या है, बल्कि यह है कि इसे बांटा कैसे जाता है।
ज़्यादातर AI मॉडल अपने बनाने वाले के प्रोडक्ट के भीतर बंद रहते हैं। आप ChatGPT को OpenAI के ज़रिए इस्तेमाल करते हैं, और मॉडल खुद कभी उनके सर्वर से बाहर नहीं निकलता। Meta, Llama के वेट्स जारी करता है, यानी वे संख्याएं जिनसे प्रशिक्षित मॉडल बनता है, ताकि कोई भी उन्हें डाउनलोड करके चला सके।
एक काम की तुलना: ज़्यादातर AI एक रेस्तरां जैसा है, जहां आप ऑर्डर करते हैं और वे पकाते हैं। Llama रेसिपी छाप देने के ज़्यादा करीब है। आप अब भी रेस्तरां में खा सकते हैं, और आप इसे खुद भी बना सकते हैं, अपने हिसाब से बदल सकते हैं, या अपनी रसोई खोल सकते हैं।
एक बात साफ़ कर लें, जिस पर आपको ऑनलाइन बहस दिखेगी। Llama को आमतौर पर ओपन सोर्स कहा जाता है, जबकि सख्ती से देखें तो यह "ओपन वेट्स" है, ऐसे लाइसेंस के साथ जिसमें कुछ शर्तें हैं, जिनमें बहुत बड़े पैमाने के व्यावसायिक इस्तेमाल पर पाबंदियां भी शामिल हैं। किसी एक व्यक्ति के लिए इससे कोई व्यावहारिक फर्क नहीं पड़ता। इस पर कोई प्रोडक्ट बना रही कंपनी के लिए लाइसेंस पढ़ना ज़रूरी है।
आप कुछ डाउनलोड न करें तब भी यह क्यों मायने रखता है
तीन नतीजे आम यूज़र तक पहुंचते हैं।
यह सस्ता है, इसलिए हर जगह है। चूंकि इसे कोई भी होस्ट कर सकता है, मुकाबला कीमत नीचे ले आता है। दूसरे प्रोडक्ट में आपको जो AI मिलता है, उसका बड़ा हिस्सा Llama मॉडलों से चलता है, बिना नाम लिए, और किसी सेवा का तेज़ या किफ़ायती टियर आमतौर पर यही होता है।
यह बिना इंटरनेट के चल सकता है। आपकी अपनी मशीन पर चलने वाला मॉडल हवाई जहाज़ में, किसी सुरक्षित माहौल में, या कहीं भी काम करता है जहां डेटा इमारत से बाहर नहीं जाना चाहिए। कोई भी होस्टेड सेवा यह नहीं दे सकती।
यह बाज़ार को ईमानदार रखता है। एक सक्षम मुफ़्त विकल्प इस बात की छत तय कर देता है कि बंद मॉडल कितना वसूल सकते हैं, जो आपके लिए अच्छा है चाहे आप कुछ भी इस्तेमाल करें।
यह असल में किन कामों में अच्छा है
इस बारे में ईमानदार रहना जोश दिखाने से ज़्यादा काम आता है। Llama कई आकारों में आता है, और सौदा हर बार वही रहता है: छोटे मॉडल बेहद तेज़ और सस्ते हैं, बड़े मॉडल ज़्यादा सक्षम हैं लेकिन चलाने में सस्ते नहीं रहते।
| काम | Llama | कहीं और बेहतर |
|---|---|---|
| झटपट तथ्यात्मक सवाल | तेज़ और काफ़ी अच्छा | नहीं |
| छोटी सूचियां, आइडिया, आसान बदलाव | बहुत अच्छा, और तुरंत | नहीं |
| कई चीज़ों पर दोहराव वाला काम | सबसे उपयुक्त, क्योंकि प्रति आइटम लागत मायने रखती है | नहीं |
| ऑफलाइन या निजी तौर पर चलाना | एकमात्र असली विकल्प | नहीं |
| ऐसी लिखाई जो कोई पूरी पढ़ेगा | चल जाता है | Claude, साफ़ तौर पर |
| पेचीदा कई-कदम वाली सोच | अग्रणी मॉडलों से कमज़ोर | GPT या Claude |
| बहुत लंबे दस्तावेज़ | सीमित | Gemini |
| पिछले कुछ हफ़्तों की कोई बात | इसे पता नहीं होता | वेब पहुंच वाला मॉडल |
पैटर्न यह है: मात्रा और रफ़्तार के लिए शानदार, रोज़मर्रा के सवालों में टक्कर का, और कठिन तर्क तथा चमकदार लिखाई में अग्रणी मॉडलों से पीछे। मुफ़्त चीज़ के लिए यह सही सौदा है, और इसीलिए "कौन बेहतर है" गलत सवाल है। जहां रफ़्तार और लागत मायने रखती है वहां इसे इस्तेमाल करें, और काम कठिन हो तो बदल लें।
इसे इस्तेमाल करने के तीन तरीके
1. किसी वर्कस्पेस के ज़रिए, बिना किसी सेटअप के। सबसे आसान विकल्प। Llama, Whizi में GPT, Claude और Gemini के साथ शामिल है, इसलिए आप झटपट सवाल इसे भेज सकते हैं और काम कठिन होते ही उसी बातचीत में किसी मज़बूत मॉडल पर चले जा सकते हैं। कुछ भी इंस्टॉल करने की ज़रूरत नहीं।
2. अपने कंप्यूटर पर। Ollama और LM Studio जैसे टूल मॉडल डाउनलोड करके उसे लोकल चलाते हैं। हकीकत यह है: आपको ठीकठाक आधुनिक मशीन चाहिए जिसमें भरपूर मेमोरी हो, आराम से वही छोटे मॉडल चलते हैं, और अच्छा GPU न हो तो जवाब किसी होस्टेड सेवा से धीमे आएंगे। बदले में, आप जो टाइप करते हैं वह आपकी मशीन से बाहर नहीं जाता, और इंटरनेट बंद होने पर भी काम चलता है। अगर निजता या ऑफलाइन इस्तेमाल आपकी ज़रूरत है तो यह सचमुच सार्थक है, वरना बेकार की मेहनत।
3. किसी API के ज़रिए। अगर आप सॉफ्टवेयर बना रहे हैं, तो प्रदाता Llama को बहुत कम प्रति-टोकन लागत पर होस्ट करते हैं, और ज़्यादा मात्रा वाले कामों में किसी अग्रणी मॉडल की जगह इसे चुनने की वजह अक्सर यही होती है।
इससे अच्छे जवाब कैसे निकलवाएं
छोटे मॉडल अग्रणी मॉडलों से अलग तरह की प्रॉम्प्ट शैली पसंद करते हैं। तीन आदतें बड़ा फर्क डालती हैं।
सीधा और ठोस लिखें। एक कॉफ़ी शॉप के लिए 10 नामों के आइडिया सूची में दो, हर एक एक लाइन में, कोई व्याख्या नहीं किसी गपशप जैसे अनुरोध से बेहतर काम करता है। छोटे मॉडल आसान और साफ़ निर्देश अच्छी तरह मानते हैं और घुमावदार निर्देशों पर भटक जाते हैं।
एक बार में एक चीज़। अग्रणी मॉडल एक ही प्रॉम्प्ट में छह शर्तें संभाल लेते हैं। छोटे मॉडल एक-एक अनुरोध की कड़ी में बेहतर करते हैं।
फ़ॉर्मेट बताएं। एक वाक्य में जवाब दो या सिर्फ़ एक नंबर वाली सूची दो उस भरती को रोक देता है जो छोटे मॉडल अनिश्चित होने पर पैदा करते हैं।
और यह भी जानिए कि कब बदलना है। अगर जवाब धुंधला है, खुद का ही खंडन करता है, या कोई साफ़ बात चूक जाता है, तो यह इशारा है कि वही सवाल किसी मज़बूत मॉडल को दे दें, न कि उसे बार-बार घुमा-फिराकर पूछते रहें। जिस वर्कस्पेस में कई मॉडल हों, वहां यह एक क्लिक है और बातचीत साथ चली आती है।
किन बातों का ध्यान रखें
इसे यह नहीं पता होता कि हाल में क्या हुआ। इसकी जानकारी उसकी ट्रेनिंग तारीख पर रुक जाती है, और जब तक यह सर्च से जुड़ा न हो, पिछले महीने का सवाल भी यह सामान्य जानकारी से, पूरे आत्मविश्वास के साथ, जवाब दे देगा।
यह चीज़ें गढ़ लेता है, हर मॉडल की तरह। छोटे मॉडल यह कुछ ज़्यादा करते हैं। किसी भी खास तथ्य, तारीख या आंकड़े को जांच लें।
मुफ़्त का मतलब निजी नहीं है, अगर यह होस्टेड है। Llama को अपनी मशीन पर चलाना निजी है। किसी और की सेवा के ज़रिए इस्तेमाल करने का मतलब है कि उनकी डेटा नीति लागू होगी, ठीक वैसे ही जैसे किसी भी दूसरे मॉडल के साथ।
संस्करण की उलझन। Llama 3 एक पीढ़ी थी, और उसके बाद नए संस्करण आ चुके हैं। अगर यह मायने रखता है तो पूछ लीजिए कि आप कौन सा संस्करण इस्तेमाल कर रहे हैं, क्योंकि पीढ़ियों के बीच क्षमता का फर्क बड़ा होता है।
- झटपट सवालों, छोटी सूचियों और दोहराव वाले कामों के लिए इसे इस्तेमाल करें, जहां रफ़्तार मायने रखती है
- जब काम में सोच-समझ या चमकदार लिखाई चाहिए हो, तब किसी मज़बूत मॉडल पर चले जाएं
- प्रॉम्प्ट सीधे रखें, एक बार में एक अनुरोध करें, और नतीजे का फ़ॉर्मेट बताएं
- इसे अपने कंप्यूटर पर तभी चलाएं जब आपको सचमुच ऑफलाइन या निजी इस्तेमाल चाहिए
- किसी भी खास तथ्य, तारीख या आंकड़े को जांचें, जैसे हर मॉडल के साथ करते हैं
- पूछें कि आप कौन सा संस्करण इस्तेमाल कर रहे हैं, क्योंकि पीढ़ियों में काफ़ी फर्क होता है
अक्सर पूछे जाने वाले सवाल
क्या Llama 3 इस्तेमाल करने के लिए कोई सॉफ्टवेयर डाउनलोड करना पड़ता है?
नहीं। इसे डाउनलोड करके अपने कंप्यूटर पर चलाना एक विकल्प है और अगर आपको ऑफलाइन या पूरी तरह निजी इस्तेमाल चाहिए तो यही सही है, लेकिन इसके लिए ठीकठाक ताकतवर मशीन चाहिए और जवाब किसी होस्टेड सेवा से धीमे मिलते हैं। ज़्यादातर लोग इसे ब्राउज़र में किसी प्लेटफ़ॉर्म के ज़रिए इस्तेमाल करते हैं, जहां यह दूसरे मॉडलों के साथ रहता है और कोई सेटअप नहीं लगता।
क्या Llama 3, ChatGPT से तेज़ है?
छोटे Llama मॉडल साफ़ तौर पर तेज़ हैं, जिससे वे छोटे सवालों, झटपट सूचियों और दोहराव वाले किसी भी काम के लिए बहुत अच्छे बन जाते हैं। सौदा क्षमता का है: पेचीदा तर्क और चमकदार लिखाई में अग्रणी मॉडल साफ़ तौर पर बेहतर हैं। समझदारी वाला तरीका यह है कि रफ़्तार के लिए Llama इस्तेमाल करें और जब कोई सवाल दिखने से ज़्यादा कठिन निकले तो बदल लें।
क्या Llama सचमुच मुफ़्त है?
मॉडल के वेट्स डाउनलोड करने के लिए मुफ़्त हैं और लाइसेंस ज़्यादातर इस्तेमाल की इजाज़त देता है, कुछ शर्तों के साथ जो मुख्य रूप से बहुत बड़े पैमाने की व्यावसायिक तैनाती पर लागू होती हैं। इसे चलाना व्यवहार में मुफ़्त नहीं है, क्योंकि इसमें या तो आपका अपना हार्डवेयर और बिजली खर्च होती है, या किसी होस्टेड प्रदाता की प्रति-टोकन फीस, जो बस अग्रणी मॉडलों की फीस से बहुत कम होती है।
अगर मैं इसे अपने कंप्यूटर पर चलाऊं तो क्या यह निजी रहता है?
हां, और इसे लोकल चलाने की सबसे मज़बूत वजह यही है। आप जो टाइप करते हैं वह आपकी मशीन से बाहर नहीं जाता, इंटरनेट बंद होने पर भी यह चलता है, और किसी प्रदाता की नीति लागू नहीं होती क्योंकि इसमें कोई प्रदाता है ही नहीं। कीमत यह है: सेटअप की मेहनत, पर्याप्त मेमोरी वाली मशीन, अच्छा GPU न होने पर धीमे जवाब, और सिर्फ़ उन छोटे मॉडलों तक सीमित रहना जो आराम से चल जाते हैं।
क्या मुझे ChatGPT या Claude की जगह Llama इस्तेमाल करना चाहिए?
जगह लेने के तौर पर, कभी-कभार ही। साथ में, अक्सर। तेज़ और आसान सवालों, बड़ी मात्रा वाले दोहराव भरे काम, और ऐसी हर चीज़ के लिए यह सही चुनाव है जो निजी तौर पर या ऑफलाइन चलनी चाहिए। ऐसी लिखाई के लिए जिसे कोई ध्यान से पढ़ेगा, कठिन कई-कदम वाली सोच के लिए, और बहुत लंबे दस्तावेज़ों के लिए, अग्रणी मॉडल साफ़ तौर पर बेहतर हैं। दोनों उपलब्ध होने का मतलब है कि चुनाव हर काम के हिसाब से होता है, कोई पक्का वादा नहीं।