De opbouw die werkt
- Onderwerp: wie of wat, doet wat, waar. a red fox sitting on a mossy rock in a pine forest
- Stijl of medium: oil painting, 35mm photograph, watercolor, 3D render, of een kunstenaar: by Ivan Shishkin.
- Licht en sfeer: golden hour, soft diffused light, dramatic rim light, foggy.
- Kader en lens: close-up, wide shot, 85mm, shallow depth of field.
- Kwaliteitswoorden: highly detailed, sharp focus, masterpiece. Twee of drie zijn genoeg.
Woorden aan het begin van de prompt wegen doorgaans zwaarder dan woorden aan het eind. Zet het onderwerp vooraan.
Een voorbeeld, uitgelegd
portrait of an old fisherman, weathered face, wool sweater, oil painting by Rembrandt, warm candlelight, dark background, close-up, 85mm, highly detailed
De eerste vijf woorden leggen het onderwerp vast. De kunstenaarsnaam bepaalt palet en penseelvoering (zie op de pagina's met kunstenaarsstijlen hoeveel één naam verandert). De lichtwoorden bepalen de sfeer, de kaderwoorden de compositie, en de laatste groep polijst het geheel. Negatieve prompt: blurry, deformed hands, extra fingers, watermark, text (meer in wat is een negatieve prompt).
Gewichten en nadruk
In Automatic1111, Forge, Fooocus en ComfyUI bepalen ronde haakjes het gewicht van een term: (red scarf:1.3) betekent 30% meer aandacht, (background:0.7) minder. Vierkante haken verlagen het gewicht in Automatic1111. Blijf tussen 0,6 en 1,4: daarbuiten wordt het beeld vaak slechter. Gebruik gewichten om een detail te redden dat het model blijft negeren, niet op elk woord.
Veelgemaakte fouten
- Ontkenningen: "a room without windows" levert vaak ramen op. Zet wat je niet wilt in de negatieve prompt.
- Te veel ideeën: één onderwerp per afbeelding. Bij SD 1.5 en SDXL bevat één CLIP-chunk 75 tokens (ongeveer 60 woorden); Automatic1111 zet wat daarna komt in een tweede chunk, en tools die niet chunken knippen het af.
- Tegenstrijdige stijlen: photorealistic watercolor geeft een modderig resultaat.
- Alles tegelijk veranderen: zet de seed vast en verander één woord per keer om te leren wat elk woord doet.
Verschillen tussen modellen
SD 1.5 en SDXL reageren op lijstjes met trefwoorden zoals het voorbeeld hierboven. Stable Diffusion 3 en 3.5 begrijpen natuurlijke zinnen beter, kunnen meerdere onderwerpen plaatsen ("a cat on the left, a dog on the right") en geven korte tekst tussen aanhalingstekens weer. Welk model je ook gebruikt, de 82 gedocumenteerde prompts op deze site tonen de parameters achter elke afbeelding, en de promptgenerator maakt van een paar woorden een volledige prompt.