Przejdź do treści
LaFoto

Słowniczek obrazów AI

Czym jest LoRA?

Niewielki, wytrenowany dodatek, który uczy bazowy model konkretnego stylu, postaci lub obiektu bez ponownego trenowania całego modelu.

LoRA — skrót od Low-Rank Adaptation — to mały plik, który modyfikuje duży model obrazowy tak, by wytwarzał określony styl, postać, obiekt lub estetykę. Zamiast ponownie trenować model zajmujący kilka gigabajtów, LoRA uczy się zwartego zestawu korekt — zwykle od kilkudziesięciu do kilkuset megabajtów — nakładanych na bazowy model w czasie generacji.
Mały mosiężny pierścień-adapter spoczywa na dużym obiektywie na ciepłym papierze

Problem, który rozwiązują LoRA

Bazowy model obrazowy wie ogromnie dużo ogólnie i nic o Państwa konkretnym temacie. Nie widział Państwa produktu, postaci, stylu ilustracji ani twarzy. Nauczenie go któregokolwiek z nich poprzez ponowne trenowanie całego modelu wymaga sprzętu i danych poza zasięgiem niemal wszystkich — i tworzy kolejny wielogigabajtowy plik dla każdej wariacji.

Dlaczego „low rank” czyni plik małym

Wgląd polega na tym, że korekta potrzebna do wyspecjalizowania modelu jest znacznie prostsza niż sam model. Zamiast uczyć się nowej wartości dla każdej wagi, LoRA uczy się zwartej faktoryzacji — dwóch małych macierzy, których iloczyn przybliża zmianę — i to przybliżenie okazuje się wystarczające. Efekt to plik mniejszy o dwa–trzy rzędy wielkości od modyfikowanego modelu, możliwy do wytrenowania na pojedynczej konsumenckiej karcie graficznej w minuty–godziny.

Na czym faktycznie się je trenuje

Dominują cztery rzeczy. Styl — by wszystko wychodziło w jednym rejestrze ilustracyjnym lub fotograficznym. Postać — by ta sama osoba lub stworzenie pojawiało się spójnie na wielu obrazach. Obiekt — zwykle produkt, który musi wyglądać dokładnie jak on sam. I koncept, z którym bazowy model sobie słabo radzi — konkretna konstrukcja odzieży, detal architektoniczny, niszowy sprzęt.

Stackowanie, wagi i gdzie zaczyna się kłopot

Można zastosować kilka LoRA naraz, każdą z własną siłą — i to tu leży większość praktycznych trudności. Dwie LoRA od stylu na pełnej sile walczą i dają papkę; LoRA postaci zbyt wysoko „przebija” tłem z treningu do każdego obrazu. Zwykłą naprawą jest obniżenie wag, nie usuwanie plików — większość problemów ze stackowaniem to problemy z „głośnością”.

Pytanie licencyjne, które się pomija

LoRA jest utworem zależnym zarówno od bazowego modelu, jak i obrazów treningowych — i żaden z tych składników nie jest automatycznie Państwa do redystrybucji. Społecznościowe LoRA mają własne licencje, z których część zabrania użytku komercyjnego, a LoRA wytrenowana na pracach żyjącego artysty w celu odtworzenia jego stylu rodzi pytanie, którego sam plik licencji nie rozstrzyga. Proszę sprawdzić, zanim oprą Państwo na niej biznes.

LoRA w skrócie

Rozwinięcie skrótu
adaptacja niskiego rzędu
Rozmiar pliku
Od dziesiątek do setek MB
Rozmiar modelu bazowego
Kilka GB
Wczytywanych naraz
Kilka, z wagami
Uczy
Stylu, postaci lub obiektu
Przenośna między modelami
Nie

Zastosowanie w praktyce

Gdzie to występuje

LoRA — questions people ask

Co oznacza skrót LoRA?
Low-Rank Adaptation. Odnosi się do techniki matematycznej, która czyni plik-dodatek małym — a nie do czegoś specyficznego dla obrazów.
Jak duży jest plik LoRA?
Zwykle od kilkudziesięciu do kilkuset megabajtów, wobec kilku gigabajtów bazowego modelu, który modyfikuje.
Czy potrzebuję LoRA, by generować dobre obrazy?
Nie. Służy do dodania czegoś, czego bazowy model nie zna — Państwa produktu, postaci, konkretnego stylu. Do ogólnych obrazów wystarczy model bazowy.
Czy mogę użyć więcej niż jednej LoRA naraz?
Tak, każdej z własną siłą. Dwie mocne LoRA od stylu mają tendencję do konfliktu; obniżenie wag zwykle rozwiązuje sprawę lepiej niż usunięcie jednej.
Czy mogę wytrenować własną LoRA?
Tak — to najbardziej dostępna forma personalizacji modelu. Wystarczy umiarkowany zestaw obrazów i konsumencka karta graficzna. Jakość zależy znacznie bardziej od spójności obrazów treningowych niż od ich liczby.
Czy LoRA działają z każdym modelem?
Nie. LoRA jest trenowana względem konkretnej bazowej architektury i nie przeniesie się na niepowiązaną. LoRA dla jednej rodziny modeli nie załaduje się do innej.
Czy LoRA można swobodnie używać komercyjnie?
Nie automatycznie. Każda ma własną licencję, a licencja modelu bazowego również obowiązuje. Część społecznościowych LoRA wyraźnie zakazuje użytku komercyjnego.

Zacznij tworzyć dziś

Wygeneruj pierwszy obraz w najlepszym generatorze obrazów AI.

Zamień zdanie w gotowy, fotorealistyczny obraz w kilka sekund — a potem dopracuj każdy szczegół. Bez konfiguracji, bez Discorda, bez GPU.

Dołącz do 4200+ twórców korzystających z LaFoto