Co to jest LoRA w Stable Diffusion?

Autor: Zaktualizowano 3 min czytania

LoRA (Low-Rank Adaptation) to mały plik, od kilku do kilkuset megabajtów, który dodaje styl, postać, produkt lub koncepcję do istniejącego modelu Stable Diffusion bez ponownego trenowania całości. Ładujesz go obok modelu bazowego, nadajesz mu wagę i możesz łączyć kilka naraz w jednym prompcie.

Jak działa LoRA

Dotrenowanie całego modelu oznacza przepisanie setek milionów do miliardów wag i plik o rozmiarze 2–7 GB dla SD 1.5 lub SDXL. LoRA zamraża model i trenuje tylko pary małych macierzy, głównie przy warstwach uwagi; iloczyn każdej pary przybliża zmianę. Wynik zapisuje „to, co nowe” w małym pliku i jest nakładany w czasie generowania, z mnożnikiem. Do wytrenowania LoRA na konsumenckim GPU często wystarcza 10–30 obrazów, a zajmuje to od minut do kilku godzin zależnie od modelu bazowego.

Jak używać LoRA

  1. Pobierz LoRA zrobioną dla twojego modelu bazowego: LoRA dla SD 1.5 nie działa z SDXL i odwrotnie; SD 3.5 ma własne.
  2. Umieść plik w folderze models/Lora Automatic1111 (lub w jego odpowiedniku w ComfyUI, Forge albo Fooocus).
  3. W Automatic1111, Forge i Fooocus wywołaj ją w prompcie przez <lora:nazwa_pliku:0.8>; w ComfyUI zamiast tego dodaj węzeł Load LoRA. Liczba to waga; zwykle używa się zakresu 0,6–1,0.
  4. Dodaj słowo wyzwalające (trigger word) podane przez autora, jeśli istnieje (imię postaci, token stylu).
  5. Dostrój: za mocna LoRA sprawia, że każdy obraz wygląda tak samo, za słaba nie zmienia nic.

Łączenie LoRA

Kilka LoRA można nałożyć na siebie: styl przy 0,7, postać przy 0,8, wzmacniacz detali przy 0,4. Obniżaj każdą wagę, gdy dokładasz kolejne, i ustal seed na czas strojenia, inaczej nie zobaczysz, co robi każda z nich. LoRA wytrenowane na tym samym pojęciu walczą ze sobą; wybierz jedną.

LoRA, embeddingi, checkpointy: co wybrać?

TypRozmiarNajlepsze doJak się używa
Checkpoint (fine-tune)2–7 GB (SD 1.5, SDXL)całej estetyki (realistycznej, anime)zastępuje model bazowy
LoRAod kilku do kilkuset MBstylu, postaci, obiektu, pozy<lora:nazwa:waga> w prompcie lub węzeł Load LoRA w ComfyUI
Textual inversion (embedding)od kilku do 100 KBpojedynczego tokena, często negatywnegonazwa tokena w prompcie

Typowy zestaw to jeden dobry checkpoint i LoRA zmieniane w zależności od obrazu.

Gdzie szukać LoRA

Civitai i Hugging Face hostują ich dziesiątki tysięcy, z przykładowymi obrazami, słowami wyzwalającymi i wymaganym modelem bazowym. Sprawdź licencję: część zabrania użytku komercyjnego, a Civitai od maja 2025 roku usuwa LoRA prawdziwych osób. Nasze zestawienie stylów artystów to dobra alternatywa dla stylów: nazwisko w prompcie często robi to samo, co LoRA stylu, bez pobierania czegokolwiek.

Podobne pytania

Czy LoRA spowalnia generowanie?

Prawie wcale: Automatic1111 i ComfyUI scalają LoRA z wagami modelu przed samplowaniem, więc każdy krok kosztuje tyle samo. Chwilę zajmuje tylko samo scalenie, gdy ładujesz lub zmieniasz LoRA.

Czy mogę używać LoRA na tej stronie?

Własnych nie. Narzędzia działają na stałych modelach, do których serwis dodaje już małe LoRA poprawiające detale i noise offset. Strony txt2img dla zalogowanych mogą w przyszłości udostępnić wybrane LoRA.

Co oznacza liczba w <lora:nazwa:0.8>?

Siłę, z jaką nakładane są zmiany LoRA: 1,0 to dokładnie to, co wytrenował autor, 0,5 to połowa efektu, a wartości powyżej 1,2 zwykle zniekształcają obraz.