Перейти до вмісту
LaFoto

Глосарій зображень ШІ

Що таке LoRA?

Невеликий натренований додаток, який навчає базову модель конкретного стилю, персонажа або об’єкта без повного перенавчання моделі.

LoRA — скорочення від Low-Rank Adaptation — це невеликий файл, що модифікує велику модель зображень для отримання конкретного стилю, персонажа, об’єкта чи естетики. Замість перенавчати модель на кілька гігабайтів, LoRA навчає компактний набір корекцій — зазвичай від кількох десятків до кількох сотень мегабайт — які застосовуються поверх базової моделі під час генерації.
Мале латунне перехідне кільце на великому об’єктиві, на теплому папері

Проблема, яку вирішують LoRA

Базова модель зображень знає багато загального й нічого про Ваш конкретний сюжет. Вона не бачила Ваш продукт, Вашого персонажа, Ваш стиль ілюстрації або Ваше обличчя. Навчити її цьому через повне перенавчання потребує «заліза» та даних, яких у більшості немає, і породжує окремий багатогігабайтний файл для кожного варіанту.

Чому «low-rank» робить файл малим

Інсайт у тому, що корекція для спеціалізації моделі значно простіша за саму модель. Замість вчити нове значення кожної ваги, LoRA вчить компактну факторизацію — дві малі матриці, добуток яких апроксимує зміну, — і цієї апроксимації виявляється достатньо. У підсумку файл на два–три порядки менший за модифіковану модель, і його можна натренувати на одній споживчій відеокарті за хвилини–години.

На чому їх реально тренують

Домінують чотири напрями. Стиль — щоб усе генерувалося в одному ілюстративному або фотографічному регістрі. Персонаж — щоб послідовна істота чи людина з’являлася в багатьох зображеннях. Об’єкт — зазвичай продукт, який має виглядати точно «як сам». І концепт, з яким базова модель дає слабкий результат — конкретний крій одягу, архітектурна деталь, нішеве обладнання.

Стекінг, ваги і де все ламається

Можна застосовувати кілька LoRA одночасно, кожну зі своєю «силою», і саме тут живе більшість практичних труднощів. Дві стилеві LoRA на повній силі конфліктують і дають «кашу»; занадто висока вага персонажної LoRA «підмішує» фон навчання в кожне зображення. Типовий фікс — зменшити ваги, а не вимикати файли: більшість проблем стекінгу — це проблеми «гучності».

Питання ліцензування, яке часто пропускають

LoRA є похідною і від базової моделі, і від зображень, на яких її вчили — і жодне з цього автоматично не Ваше для поширення. Спільнотні LoRA мають власні ліцензії, деякі забороняють комерційне використання, а LoRA, натренована на роботах живого митця для відтворення його стилю, підіймає питання, на яке жоден файл ліцензії однозначно не відповість. Перевірте все, перш ніж будувати бізнес.

LoRA стисло

Розшифровується як
адаптація низького рангу
Розмір файлу
Від десятків до сотень MB
Розмір базової моделі
Кілька GB
Може бути підвантажено одночасно
Кілька, з вагами
Навчає
Стилю, персонажа або об'єкта
Портативність між моделями
Ні

Застосування

Де це з'являється

головний генераторОсновний генератор — від тексту до готового зображення.Відкритиперегляд реальних prompt120 зображень із точними prompt, що їх створили.ВідкритиЗображення зі зображенняПочніть із знімка, який уже маєте.ВідкритиФоторедактор ШІЗмініть частину фото, решту збережіть.ВідкритиАпскейлер зображень ШІЗбільшення до 4K без замилення.Відкритипокращити фотоЕкспозиція, шум і відновлення старих фото.Відкритивидалення об’єкта за маскоюМасковане видалення з відбудовою фону.ВідкритиРозмити тлоЗ урахуванням глибини, не рівномірний фільтр.Відкритидодати колір до старого фотоПравдоподібний колір для ч/б.Відкритизгенерувати логотипЗнаки, що читаються на 16 пікселях.ВідкритиГенератор тату ШІЕскізи, що витримують татуювання.Відкритизгенерувати ілюстраціюІлюстрація та живопис, не фотографія.Відкритизгенерувати бізнес-портретСтудійні портрети без студії.Відкритивимоги до фото на паспортТочні вимоги й як їм відповідати.ВідкритиДизайн інтер’єру ШІПерестильте кімнату, яку можна сфотографувати.ВідкритиГлосарій зображень ШІSeed, denoise, inpainting — пояснення.Відкрити

LoRA — questions people ask

Що означає абревіатура LoRA?
Low-Rank Adaptation. Це назва математичної техніки, яка робить додатковий файл малим, а не щось специфічно «про зображення».
Який розмір файлу LoRA?
Зазвичай від десятків до кількох сотень мегабайт, на тлі кількох гігабайтів базової моделі, яку вона модифікує.
Чи потрібна мені LoRA для гарних зображень?
Ні. Вона потрібна, щоб додати те, чого базова модель не знає — Ваш продукт, Ваш персонаж, конкретний стиль. Для загальних зображень потрібна саме базова модель.
Чи можу я використовувати кілька LoRA одночасно?
Так, кожну зі своєю силою. Дві сильні стилеві LoRA схильні конфліктувати; зменшення ваг зазвичай краще вирішує це, ніж вимкнення однієї.
Чи можу я натренувати власну LoRA?
Так, і це найдоступніша форма кастомізації моделі — зазвичай достатньо помірного набору зображень і споживчої відеокарти. Якість значно більше залежить від узгодженості тренувальних знімків, ніж від їх кількості.
Чи працюють LoRA з будь-якою моделлю?
Ні. LoRA тренується під конкретну базову архітектуру і не переноситься на несумісну. LoRA для однієї сім’ї моделей не завантажується в іншу.
Чи вільні LoRA для комерції?
Не автоматично. Кожна має власну ліцензію, і ліцензія базової моделі теж діє. Деякі спільнотні LoRA прямо забороняють комерційне використання.

Споріднені терміни зображень ШІ

Почніть створювати сьогодні

Згенеруйте своє перше зображення з найкращим генератором ШІ.

Перетворіть речення на готове, фотореалістичне зображення за секунди — а потім відточуйте кожну деталь. Без налаштувань, без Discord, без GPU.

Приєднуйтеся до 4 200+ творців, які користуються LaFoto