Der Aufbau, der funktioniert
- Motiv: wer oder was, tut was, wo. a red fox sitting on a mossy rock in a pine forest
- Stil oder Medium: oil painting, 35mm photograph, watercolor, 3D render oder ein Künstler: by Ivan Shishkin.
- Licht und Stimmung: golden hour, soft diffused light, dramatic rim light, foggy.
- Ausschnitt und Objektiv: close-up, wide shot, 85mm, shallow depth of field.
- Qualitätswörter: highly detailed, sharp focus, masterpiece. Zwei oder drei genügen.
Wörter am Anfang des Prompts wiegen mehr als Wörter am Ende. Das Motiv bleibt vorn.
Ein kommentiertes Beispiel
portrait of an old fisherman, weathered face, wool sweater, oil painting by Rembrandt, warm candlelight, dark background, close-up, 85mm, highly detailed
Die ersten fünf Wörter legen das Motiv fest. Der Künstlername bestimmt Palette und Pinselstrich (wie viel ein einziger Name ändert, zeigen die Seiten der Künstlerstile). Die Lichtwörter entscheiden über die Atmosphäre, die Ausschnittwörter über die Komposition, und die letzte Gruppe poliert. Negativ-Prompt: blurry, deformed hands, extra fingers, watermark, text, mehr dazu unter Was ist ein Negativ-Prompt.
Gewichte und Betonung
In Automatic1111 und den meisten Oberflächen erhöhen Klammern das Gewicht eines Begriffs: (red scarf:1.3) bedeutet 30 % wichtiger, (background:0.7) weniger wichtig. Eckige Klammern senken es. Bleiben Sie zwischen 0,6 und 1,4: Darüber hinaus zerfällt das Bild. Nutzen Sie Gewichte, um ein Detail zu retten, das das Modell ständig ignoriert, nicht für jedes Wort.
Häufige Fehler
- Ganze Sätze und Verneinungen: „a room without windows“ erzeugt oft Fenster. Unerwünschtes gehört in den Negativ-Prompt.
- Zu viele Ideen: ein Motiv pro Bild; 75 Token (etwa 60 Wörter) sind die Grenze eines CLIP-Blocks bei SD 1.5 und SDXL, und was danach kommt, wirkt schwächer.
- Widersprüchliche Stile: photorealistic watercolor ergibt ein matschiges Ergebnis.
- Alles auf einmal ändern: Fixieren Sie den Seed und ändern Sie ein Wort nach dem anderen, um zu lernen, was jedes bewirkt.
Unterschiede zwischen den Modellen
SD 1.5 und SDXL reagieren auf Stichwortlisten wie im Beispiel oben. Stable Diffusion 3 und 3.5 verstehen natürliche Sätze besser, platzieren mehrere Motive („a cat on the left, a dog on the right“) und stellen kurzen Text in Anführungszeichen dar. Unabhängig vom Modell zeigen die 69 dokumentierten Prompts dieser Seite alle Parameter hinter jedem Bild, und der Prompt-Generator macht aus wenigen Wörtern einen vollständigen Prompt.