דלגו לתוכן
LaFoto

מילון מונחי תמונות AI

מהי LoRA?

תוסף מאומן קטן שמלמד מודל בסיס סגנון, דמות או אובייקט ספציפיים — בלי לאמן מחדש את כל המודל.

LoRA — קיצור של Low-Rank Adaptation — הוא קובץ קטן שמשנה מודל תמונות גדול כך שיוכל להפיק סגנון, דמות, אובייקט או אסתטיקה ספציפיים. במקום לאמן מחדש מודל בנפח של כמה ג׳יגה-בייטים, LoRA מאמן סט דחוס של התאמות — לרוב עשרות עד מאות מגה-בייטים — שמוחלות מעל מודל הבסיס בזמן היצירה.
טבעת מתאם קטנה מפליז מונחת על עדשת מצלמה גדולה על נייר חמים

הבעיה ש-LoRA פותרות

מודל תמונות בסיסי יודע המון באופן כללי ושום דבר על הנושא שלכם. הוא לא ראה את המוצר, את הדמות, את סגנון האיור או את הפנים שלכם. ללמד אותו כל אחד מאלה באמצעות אימון מלא דורש חומרה ונתונים שלא זמינים לרוב, ומפיק קובץ נוסף של ג׳יגה-בייטים לכל וריאציה.

מדוע "Low Rank" הופך את זה לקטן

התובנה היא שההתאמה הדרושה להתמחות המודל פשוטה בהרבה מהמודל עצמו. במקום ללמוד ערך חדש לכל משקל, LoRA לומד פירוק דחוס — שתי מטריצות קטנות שמכפלתן מקרבת את השינוי — והקירוב הזה מתגלה כטוב מספיק. התוצאה היא קובץ שקטן ב-2–3 סדרי גודל מהמודל שהוא משנה, הניתן לאימון על כרטיס גרפי צרכני בודד בדקות עד שעות.

על מה בפועל מאמנים אותן

שולטים ארבעה שימושים: סגנון — כך שהכול ייווצר ברגיסטר מאויר או צילומי אחד; דמות — לשימור דמות עקבית על פני תמונות רבות; אובייקט — לרוב מוצר שחייב להיראות בדיוק כמו עצמו; וקונספט שהמודל הבסיסי מתקשה בו — גזרה מסוימת בבגד, פרט אדריכלי, ציוד נישתי.

ערימה, משקלים ואיפה זה משתבש

אפשר להחיל כמה LoRA-ות במקביל, כל אחת עם עוצמה משלה — ושם נמצא רוב האתגר המעשי. שתי LoRA-ות של סגנון בעוצמה מלאה נלחמות זו בזו ומייצרות בליל; LoRA של דמות בעוצמה גבוהה מדי "מדממת" את רקע האימון לכל תמונה. לרוב הפתרון הוא הורדת עוצמות ולא הסרת קבצים — רוב בעיות הערימה הן בעיות "עוצמה".

סוגיית הרישוי שאנשים מדלגים עליה

LoRA היא יצירה נגזרת גם של מודל הבסיס וגם של התמונות ששימשו לאימונה, ושניהם לא בהכרח שלכם להפצה. לקהילת ה-LoRA יש רישיונות משלה, וחלקם אוסרים שימוש מסחרי. ו-LoRA שאומנה על עבודות של אמן חי כדי לשחזר את סגנונו מעלה שאלה משפטית ואתית שלא קובץ רישיון יפתור. לבדוק לפני שבונים עליה עסק.

LoRA על קצה המזלג

ראשי תיבות של
התאמה בדירוג נמוך
גודל קובץ
עשרות עד מאות MB
גודל דגם בסיס
כמה GB
נטען בו-זמנית
כמה, עם משקלים
מלמדת
סגנון, דמות או אובייקט
ניידת בין דגמים
לא

ליישם בפועל

היכן זה מופיע

LoRA — questions people ask

על מה ראשי התיבות LoRA עומדים?
Low-Rank Adaptation. זה מתייחס לטכניקה מתמטית שהופכת את קובץ התוסף לקטן, לא למשהו ייחודי לתמונות.
מה הגודל של קובץ LoRA?
לרוב עשרות עד כמה מאות מגה-בייטים, לעומת כמה ג׳יגה-בייטים למודל הבסיס שהוא משנה.
האם חייבים LoRA כדי להפיק תמונות טובות?
לא. התפקיד שלהן הוא להוסיף משהו שמודל הבסיס לא יודע — המוצר שלכם, הדמות שלכם, סגנון ספציפי. לתמונות כלליות מודל הבסיס מספיק.
אפשר להשתמש בכמה LoRA-ות יחד?
כן, לכל אחת עוצמה משלה. שתי LoRA-ות סגנון חזקות נוטות להתנגש; הורדת העוצמות לרוב פותרת טוב יותר מהסרת אחת.
האם אפשר לאמן LoRA משל עצמי?
כן, וזו הצורה הנגישה ביותר להתאמת מודל — סט תמונות מתון וכרטיס גרפי צרכני בדרך כלל מספיקים. האיכות תלויה הרבה יותר בעקביות התמונות מאשר בכמותן.
האם LoRA-ות עובדות על כל מודל?
לא. LoRA מאומנת מול ארכיטקטורת בסיס ספציפית ולא תעבור לארכיטקטורה בלתי-קשורה. LoRA למשפחת מודלים אחת לא תיטען לאחרת.
האם LoRA-ות חופשיות לשימוש מסחרי?
לא בהכרח. לכל אחת רישיון משלה, וגם רישיון מודל הבסיס חל. חלק מ-LoRA-ות הקהילה אוסרות שימוש מסחרי במפורש.

התחילו ליצור היום

צרו את התמונה הראשונה שלכם עם מחולל התמונות הטוב ביותר ב-AI.

הפכו משפט לתמונה מוגמרת ופוטוריאליסטית בשניות — ואז לַטְּשׁוּ כל פרט. בלי התקנות, בלי Discord, בלי GPU.

הצטרפו ל-4,200+ יוצרים שמשתמשים ב-LaFoto