מה זה LoRA ב-Stable Diffusion?

מאת עודכן 2 דקות קריאה

LoRA (Low-Rank Adaptation) הוא קובץ קטן, מכמה מגה-בייט עד כמה מאות, שמוסיף סגנון, דמות, מוצר או קונספט למודל Stable Diffusion קיים בלי לאמן אותו מחדש. טוענים אותו לצד מודל הבסיס, נותנים לו משקל, ואפשר לשלב כמה כאלה בבת אחת באותו פרומפט. אלפי LoRAs חינמיים זמינים להורדה.

איך LoRA עובד

fine-tuning של מודל שלם פירושו כתיבה מחדש של מאות מיליונים עד מיליארדי משקולות וקובץ של 2 עד 7 GB ל-SD 1.5 או SDXL. LoRA מקפיא את המודל ומאמן רק זוגות של מטריצות קטנות, בעיקר ליד שכבות ה-attention; המכפלה של כל זוג מקרבת את השינוי. התוצאה לוכדת את "מה שחדש" בקובץ קטן ומופעלת בזמן היצירה, עם מכפיל. עשר עד שלושים תמונות מספיקות לרוב כדי לאמן אחד על GPU ביתי, בין דקות לכמה שעות לפי מודל הבסיס.

איך משתמשים ב-LoRA

  1. הורידו LoRA שנוצר עבור מודל הבסיס שלכם: LoRA של SD 1.5 לא עובד עם SDXL, ולהפך; ל-SD 3.5 יש משלו.
  2. שימו את הקובץ בתיקייה models/Lora של Automatic1111 (או במקבילה שלה ב-ComfyUI, Forge או Fooocus).
  3. ב-Automatic1111, Forge ו-Fooocus, קראו לו מתוך הפרומפט עם <lora:filename:0.8>; ב-ComfyUI הוסיפו במקום זאת צומת Load LoRA. המספר הוא המשקל; 0.6 עד 1.0 הוא הטווח המקובל.
  4. הוסיפו את מילת ההפעלה (trigger word) שנתן היוצר, אם יש כזו (שם דמות, טוקן של סגנון).
  5. כווננו: חזק מדי וכל תמונה נראית אותו דבר, חלש מדי ושום דבר לא משתנה.

שילוב של כמה LoRAs

אפשר לערום כמה LoRAs: סגנון ב-0.7, דמות ב-0.8, משפר פרטים ב-0.4. הורידו כל משקל ככל שמוסיפים עוד, וקבעו את ה-seed בזמן הכוונון, אחרת אי אפשר לדעת מה כל אחד עושה. LoRAs שאומנו על אותו קונספט נלחמים זה בזה; בחרו אחד.

LoRA, embeddings, checkpoints: במה לבחור?

סוגגודללמה מתאיםאיך משתמשים
Checkpoint (fine-tune)2-7 GB (SD 1.5, SDXL)אסתטיקה שלמה (ריאליסטי, אנימה)מחליף את מודל הבסיס
LoRAכמה MB עד כמה מאות MBסגנון, דמות, אובייקט, תנוחה<lora:name:weight> בפרומפט, או צומת Load LoRA ב-ComfyUI
Textual inversion (embedding)כמה KB עד 100 KBטוקן יחיד, לעתים קרובות שלילישם הטוקן בפרומפט

שילוב נפוץ הוא checkpoint טוב אחד, עם LoRAs שמתחלפים מתמונה לתמונה.

איפה מוצאים LoRAs

Civitai ו-Hugging Face מארחים עשרות אלפים, עם תמונות לדוגמה, מילות הפעלה ומודל הבסיס שהם צריכים. בדקו את הרישיון: חלקם אוסרים שימוש מסחרי, ו-Civitai הסיר LoRAs של אנשים אמיתיים מאז מאי 2025. השוואת סגנונות האמנים שלנו היא חלופה טובה לסגנונות: שם של אמן בפרומפט עושה לעתים קרובות את מה ש-LoRA של סגנון היה עושה, בלי להוריד כלום.

שאלות נוספות שאנשים שואלים

האם LoRA מאט את היצירה?

בקושי: Automatic1111 ו-ComfyUI ממזגים את ה-LoRA לתוך משקולות המודל לפני הדגימה, ולכן כל צעד עולה אותו דבר. רק המיזוג עצמו, כשטוענים או מחליפים LoRA, לוקח רגע.

אפשר להשתמש ב-LoRAs באתר הזה?

לא במשלכם. הכלים מריצים מודלים קבועים, שאליהם האתר כבר מוסיף LoRAs קטנים לפרטים ול-noise offset. דפי txt2img של חברים רשומים עשויים לחשוף LoRAs מסוימים בעתיד.

מה המשמעות של המספר ב-<lora:name:0.8>?

העוצמה שבה מופעלים השינויים של ה-LoRA: 1.0 הוא מה שהיוצר אימן, 0.5 הוא חצי מההשפעה, וערכים מעל 1.2 בדרך כלל מעוותים את התמונה.