Πώς λειτουργεί ένα LoRA
Το fine-tuning ενός ολόκληρου μοντέλου σημαίνει επανεγγραφή εκατοντάδων εκατομμυρίων έως δισεκατομμυρίων βαρών και παραγωγή ενός αρχείου 2 έως 7 GB για SD 1.5 ή SDXL. Ένα LoRA παγώνει το μοντέλο και εκπαιδεύει μόνο ζεύγη μικρών πινάκων, κυρίως δίπλα στα επίπεδα προσοχής (attention)· το γινόμενο κάθε ζεύγους προσεγγίζει την αλλαγή. Το αποτέλεσμα συλλαμβάνει «το καινούργιο» σε ένα μικρό αρχείο και εφαρμόζεται τη στιγμή της δημιουργίας, με έναν πολλαπλασιαστή. Δέκα έως τριάντα εικόνες συχνά αρκούν για να εκπαιδεύσετε ένα LoRA σε GPU καταναλωτικής κατηγορίας, σε λεπτά έως λίγες ώρες ανάλογα με το βασικό μοντέλο.
Πώς να χρησιμοποιήσετε ένα LoRA
- Κατεβάστε ένα LoRA φτιαγμένο για το δικό σας βασικό μοντέλο: ένα LoRA για SD 1.5 δεν δουλεύει με SDXL, και αντίστροφα· το SD 3.5 έχει τα δικά του.
- Βάλτε το αρχείο στον φάκελο
models/Loraτου Automatic1111 (ή στον αντίστοιχο του ComfyUI, του Forge ή του Fooocus). - Στα Automatic1111, Forge και Fooocus, καλέστε το μέσα στο prompt με
<lora:filename:0.8>· στο ComfyUI προσθέστε αντ' αυτού έναν κόμβο Load LoRA. Ο αριθμός είναι το βάρος· 0.6 έως 1.0 είναι το συνηθισμένο εύρος. - Προσθέστε τη λέξη-σκανδάλη (trigger word) που δίνει ο δημιουργός, αν υπάρχει (ένα όνομα χαρακτήρα, ένα token στυλ).
- Ρυθμίστε: πολύ δυνατό και κάθε εικόνα μοιάζει ίδια, πολύ αδύναμο και τίποτα δεν αλλάζει.
Συνδυασμός LoRA
Πολλά LoRA μπορούν να στοιβαχτούν: ένα στυλ στο 0.7, ένας χαρακτήρας στο 0.8, ένας ενισχυτής λεπτομέρειας στο 0.4. Χαμηλώστε κάθε βάρος όσο προσθέτετε περισσότερα, και σταθεροποιήστε το seed όσο τα ρυθμίζετε, αλλιώς δεν μπορείτε να καταλάβετε τι κάνει το καθένα. Τα LoRA που εκπαιδεύτηκαν στην ίδια έννοια συγκρούονται μεταξύ τους· διαλέξτε ένα.
LoRA, embedding, checkpoint: ποιο να διαλέξετε;
| Τύπος | Μέγεθος | Κατάλληλο για | Πώς χρησιμοποιείται |
|---|---|---|---|
| Checkpoint (fine-tune) | 2–7 GB (SD 1.5, SDXL) | μια ολόκληρη αισθητική (ρεαλιστική, anime) | αντικαθιστά το βασικό μοντέλο |
| LoRA | λίγα MB έως μερικές εκατοντάδες MB | ένα στυλ, χαρακτήρα, αντικείμενο, στάση | <lora:name:weight> στο prompt, ή κόμβος Load LoRA στο ComfyUI |
| Textual inversion (embedding) | λίγα KB έως 100 KB | ένα μόνο token, συχνά αρνητικό | το όνομα του token στο prompt |
Μια συνηθισμένη πρακτική είναι ένα καλό checkpoint, με LoRA που εναλλάσσονται ανά εικόνα.
Πού να βρείτε LoRA
Το Civitai και το Hugging Face φιλοξενούν δεκάδες χιλιάδες, με δείγματα εικόνων, λέξεις-σκανδάλες και το βασικό μοντέλο που χρειάζονται. Ελέγξτε την άδεια: κάποια απαγορεύουν την εμπορική χρήση, και το Civitai έχει αφαιρέσει τα LoRA πραγματικών προσώπων από τον Μάιο του 2025. Η σύγκριση στυλ καλλιτεχνών μας είναι μια καλή εναλλακτική για στυλ: ένα όνομα στο prompt συχνά κάνει ό,τι θα έκανε ένα LoRA στυλ, χωρίς να κατεβάσετε τίποτα.