Що таке LoRA у Stable Diffusion?

Автор: Оновлено 3 хв читання

LoRA (Low-Rank Adaptation) — це невеликий файл, розміром від кількох мегабайтів до кількох сотень, який додає до наявної моделі Stable Diffusion стиль, персонажа, товар або поняття без її перенавчання. Його завантажують поруч із базовою моделлю, задають йому вагу й можуть поєднувати кілька водночас.

Як працює LoRA

Донавчити модель цілком означає переписати від сотень мільйонів до мільярдів ваг і отримати файл на 2–7 ГБ для SD 1.5 чи SDXL. LoRA «заморожує» модель і навчає лише пари невеликих матриць, здебільшого поруч із шарами уваги; добуток кожної пари наближено відтворює зміну. У результаті все «нове» вміщується в невеликий файл і застосовується під час генерації, з множником. Щоб навчити LoRA на споживчій відеокарті, часто вистачає десяти–тридцяти зображень, а триває це від кількох хвилин до кількох годин залежно від базової моделі.

Як користуватися LoRA

  1. Завантажте LoRA, створену для вашої базової моделі: LoRA для SD 1.5 не працює з SDXL, і навпаки; SD 3.5 має власні.
  2. Покладіть файл у папку models/Lora в Automatic1111 (або у відповідну папку ComfyUI, Forge, Fooocus).
  3. В Automatic1111, Forge і Fooocus викличте її в промпті: <lora:filename:0.8>; у ComfyUI натомість додайте вузол Load LoRA. Число — це вага; звичайний діапазон — від 0.6 до 1.0.
  4. Додайте тригерне слово, якщо автор його вказав (ім’я персонажа, токен стилю).
  5. Підберіть вагу: якщо вона завелика, всі зображення стають схожими одне на одне, якщо замала — нічого не змінюється.

Як поєднувати LoRA

Кілька LoRA можна накладати одну на одну: стиль із вагою 0.7, персонаж — 0.8, покращувач деталей — 0.4. Що більше LoRA додаєте, то нижчою робіть вагу кожної, і фіксуйте seed, поки їх налаштовуєте, інакше не розберете, що робить кожна. LoRA, навчені на тому самому понятті, конфліктують між собою; виберіть одну.

LoRA, ембединги, чекпойнти: що вибрати?

ТипРозмірПризначенняЯк використовується
Чекпойнт (донавчена модель)2–7 ГБ (SD 1.5, SDXL)цілісна естетика (реалізм, аніме)замінює базову модель
LoRAвід кількох МБ до кількох сотень МБстиль, персонаж, предмет, поза<lora:name:weight> у промпті або вузол Load LoRA в ComfyUI
Textual inversion (ембединг)від кількох КБ до 100 КБокремий токен, часто негативнийназва токена в промпті

Поширений підхід — тримати один добрий чекпойнт і міняти LoRA від зображення до зображення.

Де шукати LoRA

На Civitai та Hugging Face їх десятки тисяч — зі зразками зображень, тригерними словами та вказаною базовою моделлю. Перевіряйте ліцензію: деякі забороняють комерційне використання, а LoRA з реальними людьми Civitai видаляє з травня 2025 року. Для стилів доброю альтернативою є наше порівняння стилів художників: ім’я в промпті часто робить те саме, що й стильова LoRA, і нічого не треба завантажувати.

Спробуйте просто зараз, безкоштовноПорівняти 1731 стиль художників без жодної LoRA →

Часті запитання

Чи сповільнює LoRA генерацію?

Майже ні: Automatic1111 і ComfyUI перед семплінгом зливають LoRA з вагами моделі, тож кожен крок триває стільки само. Трохи часу забирає лише саме це злиття — коли ви завантажуєте або змінюєте LoRA.

Чи можна використовувати LoRA на цьому сайті?

Власні — ні. Інструменти працюють на фіксованих моделях, до яких сайт уже сам додає невеликі LoRA для деталізації та зсуву шуму (noise offset). Можливо, згодом на сторінках txt2img для зареєстрованих користувачів з’являться окремі LoRA.

Що означає число в <lora:name:0.8>?

Силу, з якою застосовуються зміни LoRA: 1.0 — повний ефект, закладений автором, 0.5 — половина ефекту, а значення понад 1.2 зазвичай спотворюють зображення.