Τι είναι το LoRA στο Stable Diffusion;

Από Ενημερώθηκε 3 λεπτά ανάγνωσης

Το LoRA (Low-Rank Adaptation) είναι ένα μικρό αρχείο, από λίγα megabyte έως μερικές εκατοντάδες, που προσθέτει ένα στυλ, έναν χαρακτήρα, ένα προϊόν ή μια έννοια σε ένα υπάρχον μοντέλο Stable Diffusion χωρίς να το επανεκπαιδεύσει. Το φορτώνετε δίπλα στο βασικό μοντέλο, του δίνετε ένα βάρος και μπορείτε να συνδυάσετε πολλά ταυτόχρονα.

Πώς λειτουργεί ένα LoRA

Το fine-tuning ενός ολόκληρου μοντέλου σημαίνει επανεγγραφή εκατοντάδων εκατομμυρίων έως δισεκατομμυρίων βαρών και παραγωγή ενός αρχείου 2 έως 7 GB για SD 1.5 ή SDXL. Ένα LoRA παγώνει το μοντέλο και εκπαιδεύει μόνο ζεύγη μικρών πινάκων, κυρίως δίπλα στα επίπεδα προσοχής (attention)· το γινόμενο κάθε ζεύγους προσεγγίζει την αλλαγή. Το αποτέλεσμα συλλαμβάνει «το καινούργιο» σε ένα μικρό αρχείο και εφαρμόζεται τη στιγμή της δημιουργίας, με έναν πολλαπλασιαστή. Δέκα έως τριάντα εικόνες συχνά αρκούν για να εκπαιδεύσετε ένα LoRA σε GPU καταναλωτικής κατηγορίας, σε λεπτά έως λίγες ώρες ανάλογα με το βασικό μοντέλο.

Πώς να χρησιμοποιήσετε ένα LoRA

  1. Κατεβάστε ένα LoRA φτιαγμένο για το δικό σας βασικό μοντέλο: ένα LoRA για SD 1.5 δεν δουλεύει με SDXL, και αντίστροφα· το SD 3.5 έχει τα δικά του.
  2. Βάλτε το αρχείο στον φάκελο models/Lora του Automatic1111 (ή στον αντίστοιχο του ComfyUI, του Forge ή του Fooocus).
  3. Στα Automatic1111, Forge και Fooocus, καλέστε το μέσα στο prompt με <lora:filename:0.8>· στο ComfyUI προσθέστε αντ' αυτού έναν κόμβο Load LoRA. Ο αριθμός είναι το βάρος· 0.6 έως 1.0 είναι το συνηθισμένο εύρος.
  4. Προσθέστε τη λέξη-σκανδάλη (trigger word) που δίνει ο δημιουργός, αν υπάρχει (ένα όνομα χαρακτήρα, ένα token στυλ).
  5. Ρυθμίστε: πολύ δυνατό και κάθε εικόνα μοιάζει ίδια, πολύ αδύναμο και τίποτα δεν αλλάζει.

Συνδυασμός LoRA

Πολλά LoRA μπορούν να στοιβαχτούν: ένα στυλ στο 0.7, ένας χαρακτήρας στο 0.8, ένας ενισχυτής λεπτομέρειας στο 0.4. Χαμηλώστε κάθε βάρος όσο προσθέτετε περισσότερα, και σταθεροποιήστε το seed όσο τα ρυθμίζετε, αλλιώς δεν μπορείτε να καταλάβετε τι κάνει το καθένα. Τα LoRA που εκπαιδεύτηκαν στην ίδια έννοια συγκρούονται μεταξύ τους· διαλέξτε ένα.

LoRA, embedding, checkpoint: ποιο να διαλέξετε;

ΤύποςΜέγεθοςΚατάλληλο γιαΠώς χρησιμοποιείται
Checkpoint (fine-tune)2–7 GB (SD 1.5, SDXL)μια ολόκληρη αισθητική (ρεαλιστική, anime)αντικαθιστά το βασικό μοντέλο
LoRAλίγα MB έως μερικές εκατοντάδες MBένα στυλ, χαρακτήρα, αντικείμενο, στάση<lora:name:weight> στο prompt, ή κόμβος Load LoRA στο ComfyUI
Textual inversion (embedding)λίγα KB έως 100 KBένα μόνο token, συχνά αρνητικότο όνομα του token στο prompt

Μια συνηθισμένη πρακτική είναι ένα καλό checkpoint, με LoRA που εναλλάσσονται ανά εικόνα.

Πού να βρείτε LoRA

Το Civitai και το Hugging Face φιλοξενούν δεκάδες χιλιάδες, με δείγματα εικόνων, λέξεις-σκανδάλες και το βασικό μοντέλο που χρειάζονται. Ελέγξτε την άδεια: κάποια απαγορεύουν την εμπορική χρήση, και το Civitai έχει αφαιρέσει τα LoRA πραγματικών προσώπων από τον Μάιο του 2025. Η σύγκριση στυλ καλλιτεχνών μας είναι μια καλή εναλλακτική για στυλ: ένα όνομα στο prompt συχνά κάνει ό,τι θα έκανε ένα LoRA στυλ, χωρίς να κατεβάσετε τίποτα.

Ερωτήσεις που κάνουν συχνά οι χρήστες

Επιβραδύνει ένα LoRA τη δημιουργία;

Ελάχιστα: τα Automatic1111 και ComfyUI συγχωνεύουν το LoRA στα βάρη του μοντέλου πριν από τη δειγματοληψία, οπότε κάθε βήμα κοστίζει το ίδιο. Μόνο αυτή η συγχώνευση, όταν φορτώνετε ή αλλάζετε LoRA, παίρνει μια στιγμή.

Μπορώ να χρησιμοποιήσω LoRA σε αυτόν τον ιστότοπο;

Όχι δικά σας. Τα εργαλεία τρέχουν προκαθορισμένα μοντέλα, στα οποία ο ιστότοπος προσθέτει ήδη μικρά LoRA λεπτομέρειας και noise offset. Οι σελίδες txt2img των μελών ίσως προσφέρουν συγκεκριμένα LoRA στο μέλλον.

Τι σημαίνει ο αριθμός στο <lora:name:0.8>;

Την ένταση με την οποία εφαρμόζονται οι αλλαγές του LoRA: το 1.0 είναι αυτό που εκπαίδευσε ο δημιουργός, το 0.5 το μισό αποτέλεσμα, τιμές πάνω από 1.2 συνήθως παραμορφώνουν την εικόνα.