कंटेंट पर जाएँ
LaFoto

AI इमेज शब्दकोश

LoRA क्या है?

एक छोटा प्रशिक्षित ऐड-ऑन जो किसी base model को बिना पूरा दुबारा ट्रेन किए किसी विशिष्ट शैली, किरदार या ऑब्जेक्ट को सिखा देता है।

LoRA — Low-Rank Adaptation का संक्षेप — एक छोटी फ़ाइल है जो बड़े इमेज model में बदलाव करके किसी एक शैली, किरदार, ऑब्जेक्ट या एस्थेटिक को उत्पन्न कराती है। कई गीगाबाइट के model को दुबारा ट्रेन करने के बजाय, LoRA समायोजनों का एक कॉम्पैक्ट सेट ट्रेन करती है — आम तौर पर कुछ दर्जन से कुछ सौ मेगाबाइट — जो जनरेशन के समय base model पर ऊपर से लागू होता है।
गर्म कागज पर बड़े कैमरा लेंस पर रखा छोटा पीतल एडेप्टर रिंग

LoRA किस समस्या को सुलझाता है

एक base इमेज model को सामान्य रूप से बहुत कुछ आता है पर आपके खास विषय के बारे में कुछ नहीं। उसने न आपका प्रोडक्ट देखा है, न आपका किरदार, न आपकी इलस्ट्रेशन शैली, न आपका चेहरा। इन्हें सिखाने के लिए पूरे model को दुबारा ट्रेन करना ऐसे हार्डवेयर और डेटा माँगता है जो लगभग सबकी पहुँच से बाहर है — और हर वैरिएशन के लिए एक और मल्टी-गीगाबाइट फ़ाइल बन जाती है।

“Low rank” इसे छोटा कैसे बनाता है

बात यह है कि model को विशेषज्ञ बनाने के लिए जो समायोजन चाहिए, वह model से कहीं सरल होता है। हर weight का नया मान सीखने के बजाय LoRA एक कॉम्पैक्ट factorisation सीखती है — दो छोटी मैट्रिसें जिनका गुणनफल वांछित बदलाव का सन्निकटन देता है — और यह सन्निकटन काफ़ी अच्छा निकलता है। नतीजा: उस model से दो-तीन गुना नहीं, बल्कि दो-तीन orders छोटा फ़ाइल, जिसे एक उपभोक्ता ग्राफ़िक्स कार्ड पर मिनटों से घंटों में ट्रेन किया जा सकता है।

लोग इन्हें असल में किस पर ट्रेन करते हैं

चार चीज़ें हावी रहती हैं। एक शैली — ताकि हर जनरेटेड छवि एक ही इलस्ट्रेटिव या फ़ोटोग्राफ़िक रजिस्टर में निकले। एक किरदार — ताकि एकसमान व्यक्ति या प्राणी कई छवियों में बना रहे। एक ऑब्जेक्ट — आम तौर पर कोई प्रोडक्ट जिसे हूबहू वैसा ही दिखना है। और कोई ऐसा कॉन्सेप्ट जिसे base model कमज़ोर संभालता है — कोई विशिष्ट परिधान-निर्माण, स्थापत्य विवरण, या निच उपकरण।

स्टैकिंग, weights और कहाँ गलती होती है

एक साथ कई LoRA लगाए जा सकते हैं, प्रत्येक अपनी ताकत के साथ — और व्यवहार की ज़्यादातर पेचीदगियाँ यहीं होती हैं। दो शैली-LoRA पूरी ताकत पर आपस में लड़ते हैं और गड़बड़ देते हैं; कोई किरदार-LoRA बहुत अधिक weight पर हर छवि में अपना ट्रेनिंग बैकग्राउंड घोल देता है। आम इलाज weights कम करना है, फ़ाइलें हटाना नहीं — स्टैकिंग की अधिकांश समस्याएँ मात्रा की होती हैं।

लाइसेंसिंग का वह सवाल जिसे लोग टाल देते हैं

LoRA, base model और जिन छवियों पर इसे ट्रेन किया गया — दोनों की व्युत्पत्ति है, और दोनों ही स्वतः आपके पुनर्वितरण के नहीं हो जाते। समुदाय की LoRA अपनी-अपनी लाइसेंस के साथ आती हैं, जिनमें कुछ व्यावसायिक उपयोग मना करती हैं; और किसी जीवित कलाकार की शैली को दोहराने के लिए उसकी रचना पर ट्रेन की गई LoRA ऐसा प्रश्न खड़ा करती है जिसे कोई लाइसेंस फ़ाइल अंतिम रूप से नहीं निपटाती। किसी व्यवसाय की बुनियाद रखने से पहले जाँच लें।

LoRA एक नज़र में

पूरा नाम
लो-रैंक अनुकूलन
फ़ाइल आकार
दहाइयों से सैकड़ों MB
बेस मॉडल आकार
कई GB
एक साथ लोड
कई, वेट्स सहित
सिखाता है
एक स्टाइल, कैरेक्टर या ऑब्जेक्ट
मॉडलों के बीच पोर्टेबल
नहीं

प्रयोग में लाएँ

यह कहाँ दिखता है

मुख्य जनरेटरमुख्य जेनरेटर — टेक्स्ट से तैयार इमेज।खोलेंवास्तविक प्रॉम्प्ट ब्राउज़ करें120 छवियाँ, ठीक वही prompts जिनसे बनीं।खोलेंइमेज-टू-इमेजअपनी मौजूद तस्वीर से शुरुआत करें।खोलेंAI फोटो एडिटरफ़ोटो का एक भाग बदलें, बाकी जस का तस।खोलेंAI इमेज अपस्केलर4K तक बड़ा करें, बिना स्मियरिंग के।खोलेंफोटो को बेहतर करेंएक्सपोज़र, नॉइज़ और पुरानी फ़ोटो बहाली।खोलेंमास्क किए गए ऑब्जेक्ट हटानामास्क करके हटाएँ, बैकग्राउंड दोबारा बने।खोलेंबैकग्राउंड ब्लर करेंगहराई-सचेत, एक जैसा फ़िल्टर नहीं।खोलेंपुरानी फोटो में रंग जोड़ेंकाला-सफेद के लिए यथार्थपूर्ण रंग।खोलेंलोगो जनरेट करें16 पिक्सेल पर भी साफ़ पढ़ने योग्य निशान।खोलेंAI टैटू जनरेटरऐसे डिज़ाइन जो टैटू बनकर भी टिकें।खोलेंइलस्ट्रेशन जनरेट करेंइलस्ट्रेशन और पेंटिंग, फ़ोटो नहीं।खोलेंहेडशॉट जनरेट करेंस्टूडियो-ग्रेड पोर्ट्रेट, बिना स्टूडियो।खोलेंपासपोर्ट फोटो आवश्यकताएँसटीक विनिर्देश, और उसे कैसे पूरा करें।खोलेंAI इंटीरियर डिज़ाइनजिस कमरे की फ़ोटो ले सकें, उसे नया रूप दें।खोलेंAI इमेज शब्दावलीSeed, denoise, inpainting — व्याख्या।खोलें

LoRA — questions people ask

LoRA किसका संक्षेप है?
Low-Rank Adaptation। यह उस गणितीय तकनीक की ओर इशारा करता है जो ऐड-ऑन फ़ाइल को छोटा बनाती है, न कि किसी इमेज-विशेष बात की ओर।
LoRA फ़ाइल कितनी बड़ी होती है?
आम तौर पर कुछ दर्जन से कुछ सौ मेगाबाइट; जबकि जिस base model को यह बदलती है वह कई गीगाबाइट का होता है।
अच्छी छवियाँ बनाने के लिए क्या मुझे LoRA चाहिए?
नहीं। वे तभी काम आती हैं जब base model को कुछ नया सिखाना हो — आपका प्रोडक्ट, आपका किरदार, कोई विशिष्ट शैली। सामान्य छवियों के लिए base model ही उपयुक्त है।
क्या मैं एक साथ एक से अधिक LoRA चला सकता/सकती हूँ?
हाँ, और हर एक की अपनी ताकत रख सकते हैं। दो मज़बूत शैली-LoRA आम तौर पर आपस में टकराते हैं; किसी एक को हटाने से बेहतर weights घटाना होता है।
क्या मैं अपनी LoRA ट्रेन कर सकता/सकती हूँ?
हाँ, और यह model कस्टमाइज़ेशन का सबसे सुलभ रूप है — सामान्यतः कुछ सुसंगत छवियाँ और एक उपभोक्ता ग्राफ़िक्स कार्ड काफ़ी होते हैं। गुणवत्ता संख्या से कम, ट्रेनिंग छवियों की एकरूपता से अधिक प्रभावित होती है।
क्या LoRA किसी भी model के साथ काम करती हैं?
नहीं। LoRA किसी विशिष्ट base आर्किटेक्चर के विरुद्ध ट्रेन होती है और असंबंधित आर्किटेक्चर में ट्रांसफ़र नहीं होती। एक model परिवार की LoRA दूसरे में लोड नहीं होगी।
क्या LoRA स्वतः व्यावसायिक उपयोग के लिए मुक्त हैं?
नहीं। हर LoRA की अपनी लाइसेंस शर्तें होती हैं, और base model की लाइसेंस भी लागू होती है। कुछ सामुदायिक LoRA व्यावसायिक उपयोग स्पष्ट रूप से निषिद्ध करती हैं।

आज ही बनाना शुरू करें

सबसे अच्छे AI इमेज जेनरेटर से अपनी पहली इमेज जनरेट करें।

एक वाक्य को कुछ सेकंड में तैयार, फ़ोटो-यथार्थवादी इमेज में बदलें — फिर हर डिटेल रिफ़ाइन करें। कोई सेटअप नहीं, कोई Discord नहीं, कोई GPU नहीं।

LaFoto इस्तेमाल करने वाले 4,200+ क्रिएटर्स से जुड़ें