Den struktur, der virker
- Motiv: hvem eller hvad, der gør hvad, og hvor. a red fox sitting on a mossy rock in a pine forest
- Stil eller medie: oil painting, 35mm photograph, watercolor, 3D render eller en kunstner: by Ivan Shishkin.
- Lys og stemning: golden hour, soft diffused light, dramatic rim light, foggy.
- Beskæring og objektiv: close-up, wide shot, 85mm, shallow depth of field.
- Kvalitetsord: highly detailed, sharp focus, masterpiece. To eller tre er nok.
Ord i begyndelsen af prompten vejer som regel tungere end ord i slutningen. Hold motivet forrest.
Et kommenteret eksempel
portrait of an old fisherman, weathered face, wool sweater, oil painting by Rembrandt, warm candlelight, dark background, close-up, 85mm, highly detailed
De første fem ord fastlægger motivet. Kunstnernavnet bestemmer palet og penselstrøg (se, hvor meget ét navn ændrer, på siderne med kunstnerstile). Lysordene afgør stemningen, beskæringsordene kompositionen, og den sidste gruppe pudser af. Negativ prompt: blurry, deformed hands, extra fingers, watermark, text (mere i hvad er en negativ prompt).
Vægte og betoning
I Automatic1111, Forge, Fooocus og ComfyUI sætter parenteser vægten på et udtryk: (red scarf:1.3) betyder 30 % mere opmærksomhed, (background:0.7) mindre. Firkantede parenteser sænker vægten i Automatic1111. Hold dig mellem 0,6 og 1,4: uden for det leje bliver billedet ofte dårligere. Brug vægte til at redde en detalje, modellen bliver ved med at ignorere, ikke på hvert eneste ord.
Typiske fejl
- Negationer: "a room without windows" giver ofte vinduer. Sæt det uønskede i den negative prompt.
- For mange idéer: ét motiv pr. billede. Med SD 1.5 og SDXL rummer én CLIP-blok 75 tokens (cirka 60 ord); Automatic1111 lægger resten i en blok nummer to, og værktøjer uden den funktion klipper det af.
- Modstridende stilarter: photorealistic watercolor giver et mudret resultat.
- At ændre alt på én gang: fastlås seedet, og skift ét ord ad gangen for at lære, hvad hvert ord gør.
Forskelle mellem modellerne
SD 1.5 og SDXL reagerer på nøgleordslister som eksemplet ovenfor. Stable Diffusion 3 og 3.5 forstår naturlige sætninger bedre, kan placere flere motiver ("a cat on the left, a dog on the right") og gengive korte tekster i anførselstegn. Uanset model viser de 82 dokumenterede prompts på dette websted parametrene bag hvert billede, og promptgeneratoren udvider et par ord til en komplet prompt.