Qu’est-ce qu’un LoRA dans Stable Diffusion ?

Par Mis à jour le 3 min de lecture

Un LoRA (Low-Rank Adaptation) est un petit fichier, en général de 20 à 150 Mo, qui ajoute un style, un personnage, un produit ou un concept à un modèle Stable Diffusion existant sans le ré-entraîner. On le charge à côté du modèle de base, on l’appelle dans le prompt avec un poids, et on peut en combiner plusieurs.

Comment fonctionne un LoRA

Ré-entraîner un modèle entier revient à réécrire des milliards de poids et à produire un fichier de 2 à 7 Go. Un LoRA gèle le modèle et n’entraîne que deux petites matrices par couche d’attention dont le produit approche le changement. Le résultat capture « ce qui est nouveau » en quelques mégaoctets et s’applique à la volée, à la génération, avec un multiplicateur. Dix à trente images et quelques minutes sur une carte grand public suffisent pour en entraîner un.

Comment utiliser un LoRA

  1. Téléchargez un LoRA fait pour votre modèle de base : un LoRA SD 1.5 ne fonctionne pas avec SDXL, et inversement ; SD 3.5 a les siens.
  2. Placez le fichier dans models/Lora d’Automatic1111 (ou le dossier équivalent de ComfyUI, Forge, Fooocus).
  3. Appelez-le dans le prompt : <lora:nomdufichier:0.8>. Le nombre est le poids ; 0,6 à 1,0 est la plage habituelle.
  4. Ajoutez le mot déclencheur indiqué par l’auteur s’il y en a un (un nom de personnage, un token de style).
  5. Ajustez : trop fort, toutes les images se ressemblent ; trop faible, rien ne change.

Combiner des LoRA

Plusieurs LoRA s’empilent : un style à 0,7, un personnage à 0,8, un amplificateur de détails à 0,4. Gardez la somme des poids autour de 1,5 à 2 au maximum, et fixez la seed pendant les réglages, sinon impossible de savoir ce que fait chacun. Deux LoRA entraînés sur le même concept se battent ; choisissez-en un.

LoRA, embeddings, checkpoints : lequel choisir ?

TypeTailleIdéal pourUtilisation
Checkpoint (fine-tune)2–7 Goune esthétique entière (réaliste, anime)remplace le modèle de base
LoRA20–150 Moun style, un personnage, un objet, une pose<lora:nom:poids> dans le prompt
Textual inversion (embedding)10–100 Koun seul token, souvent négatifle nom du token dans le prompt

La plupart des gens gardent un bon checkpoint et changent de LoRA selon l’image.

Où trouver des LoRA

Civitai et Hugging Face en hébergent des dizaines de milliers, avec images d’exemple, mots déclencheurs et modèle de base requis. Vérifiez la licence : beaucoup interdisent l’usage commercial ou la reproduction de personnes réelles. Notre comparaison de styles d’artistes est une bonne alternative pour les styles : un nom dans le prompt fait souvent ce qu’un LoRA de style ferait, sans rien télécharger.

Questions fréquentes

Un LoRA ralentit-il la génération ?

À peine : il ajoute quelques petites multiplications de matrices par étape. Le premier chargement prend une seconde ou deux ; ensuite le coût est négligeable.

Peut-on utiliser des LoRA sur ce site ?

Pas encore : les outils publics tournent avec des modèles fixes. Les pages txt2img des membres pourront exposer des LoRA précis à l’avenir.

Que signifie le nombre dans <lora:nom:0.8> ?

La force avec laquelle les changements du LoRA sont appliqués : 1,0 correspond à ce que l’auteur a entraîné, 0,5 à la moitié de l’effet, et au-delà de 1,2 l’image se déforme en général.