O que é um LoRA no Stable Diffusion?

Por Atualizado em 3 min de leitura

Um LoRA (Low-Rank Adaptation) é um arquivo pequeno, de alguns megabytes a algumas centenas, que acrescenta um estilo, um personagem, um produto ou um conceito a um modelo Stable Diffusion existente, sem retreiná-lo. Você o carrega junto com o modelo base, define um peso para ele e pode combinar vários ao mesmo tempo.

Como um LoRA funciona

Fazer o fine-tuning de um modelo inteiro significa reescrever de centenas de milhões a bilhões de pesos e gerar um arquivo de 2 a 7 GB, no caso do SD 1.5 ou do SDXL. Um LoRA congela o modelo e treina apenas pares de matrizes pequenas, na maioria junto às camadas de atenção; o produto de cada par aproxima a mudança. O resultado guarda “o que há de novo” em um arquivo pequeno e é aplicado na hora, no momento da geração, com um multiplicador. De dez a trinta imagens costumam bastar para treinar um em uma GPU doméstica, em um tempo que vai de minutos a algumas horas, conforme o modelo base.

Como usar um LoRA

  1. Baixe um LoRA feito para o seu modelo base: um LoRA de SD 1.5 não funciona com o SDXL, e vice-versa; o SD 3.5 tem os seus próprios.
  2. Coloque o arquivo em models/Lora do Automatic1111 (ou na pasta equivalente do ComfyUI, do Forge ou do Fooocus).
  3. No Automatic1111, no Forge e no Fooocus, chame-o no prompt com <lora:filename:0.8>; no ComfyUI, adicione um nó Load LoRA. O número é o peso; a faixa habitual vai de 0,6 a 1,0.
  4. Acrescente a palavra de ativação (trigger word) indicada pelo autor, se houver (um nome de personagem, um token de estilo).
  5. Ajuste: forte demais, todas as imagens ficam iguais; fraco demais, nada muda.

Como combinar LoRAs

Dá para empilhar vários LoRAs: um estilo em 0,7, um personagem em 0,8, um realçador de detalhes em 0,4. Reduza cada peso à medida que acrescenta outros LoRAs e fixe a seed enquanto faz os ajustes; caso contrário, não dá para saber o que cada um faz. LoRAs treinados no mesmo conceito brigam entre si; escolha um só.

LoRA, embeddings, checkpoints: qual escolher?

TipoTamanhoIdeal paraComo se usa
Checkpoint (fine-tune)2–7 GB (SD 1.5, SDXL)uma estética inteira (realista, anime)substitui o modelo base
LoRAde alguns MB a algumas centenas de MBum estilo, personagem, objeto, pose<lora:name:weight> no prompt, ou um nó Load LoRA no ComfyUI
Inversão textual (embedding)de alguns KB a 100 KBum único token, muitas vezes negativoo nome do token no prompt

Uma configuração comum é um bom checkpoint, com os LoRAs trocados a cada imagem.

Onde encontrar LoRAs

O Civitai e o Hugging Face hospedam dezenas de milhares, com imagens de exemplo, palavras de ativação e o modelo base exigido. Confira a licença: algumas proíbem o uso comercial, e o Civitai remove LoRAs de pessoas reais desde maio de 2025. Nossa comparação de estilos de artistas é uma boa alternativa para estilos: um nome no prompt muitas vezes faz o que um LoRA de estilo faria, sem precisar baixar nada.

Perguntas frequentes

Um LoRA deixa a geração mais lenta?

Quase nada: o Automatic1111 e o ComfyUI incorporam o LoRA aos pesos do modelo antes da amostragem, então cada passo custa o mesmo. Só essa incorporação, feita quando você carrega ou troca um LoRA, leva um instante.

Posso usar LoRAs neste site?

Os seus, não. As ferramentas rodam modelos fixos, aos quais o site já acrescenta pequenos LoRAs de detalhe e de noise offset. As páginas de txt2img dos membros poderão oferecer LoRAs específicos no futuro.

O que significa o número em <lora:name:0.8>?

A intensidade com que as alterações do LoRA são aplicadas: 1,0 é o valor com que o autor treinou, 0,5 é metade do efeito, e valores acima de 1,2 costumam distorcer a imagem.