Vergleichstabelle
| SD 1.5 | SDXL 1.0 | SD 3 Medium | SD 3.5 Large | |
|---|---|---|---|---|
| Veröffentlichung | Okt. 2022 | Juli 2023 | Juni 2024 | Okt. 2024 |
| Parameter | 0,9 Mrd. | 3,5 Mrd. (+ Refiner) | 2 Mrd. | 8 Mrd. |
| Native Größe | 512×512 | 1024×1024 | 1024×1024 | 1024×1024 |
| VRAM (fp16) | 4–6 GB | 8 GB | 10 GB | 16 GB+ |
| Tempo (RTX 3060) | ~4 s | ~15 s | ~20 s | ~60 s |
| Prompt-Verständnis | Stichwörter | Stichwörter, bessere Komposition | Sätze, mehrere Motive | am besten |
| Text im Bild | nein | selten | ja, kurz | ja |
| Künstlernamen | stark | stark | schwach | schwach |
| Community-Modelle | Tausende | viele | wenige | wachsend |
| Lizenz | OpenRAIL-M | OpenRAIL++ | Community-Lizenz (kostenlos unter 1 Mio. $ Umsatz) | |
| Auf dieser Seite testen | SD 1.5 | SDXL | SD 3 | — |
Stable Diffusion 1.5: das Arbeitspferd
Klein, schnell, endlos angepasst. Es gibt fotorealistische und Anime-Feintunings, ControlNet-Modelle, LoRAs und Embeddings für alles. Seine Schwächen sind die Basisauflösung von 512 px, Hände und ein wörtliches Lesen der Prompts. Für eine 6-GB-Karte, für Animations-Pipelines und ControlNet-lastige Arbeit bleibt es die richtige Wahl. Das txt2img für Mitglieder dieser Seite läuft mit SD 1.5.
SDXL 1.0: Detail und Stil
Viermal so viele Pixel, ein zweiter Text-Encoder, ein Refiner für die letzten Schritte. Gesichter, Hände und Komposition haben sich stark verbessert, und Künstlernamen wirken stark und vorhersehbar, weshalb unser Vergleich von 1.731 Künstlern mit SDXL erzeugt wurde. Es braucht 8 GB und ist drei- bis viermal langsamer als 1.5. Destillierte Varianten (SDXL Turbo, LCM LoRA) bringen es auf eine Sekunde pro Bild, bei etwas Qualitätsverlust.
Stable Diffusion 3 und 3.5: Verständnis und Text
Eine neue Architektur (Diffusion-Transformer mit drei Text-Encodern), die Sätzen statt Stichwortlisten folgt: „a red cube on a blue sphere, to the left of a green cone“ kommt richtig heraus, und kurzer Text in Anführungszeichen wird korrekt dargestellt. 3 Medium hatte Anatomieprobleme, die 3.5 behoben hat; 3.5 Large ist das beste offene Modell der Familie, 3.5 Medium das ausgewogene. Künstlernamen und alte Negativ-Prompt-Gewohnheiten zählen weniger. Testen Sie Stable Diffusion 3 Medium hier.
Welches sollten Sie wählen?
- Lernen, 6-GB-Karte, ControlNet, Animation: SD 1.5.
- Illustration, Porträts, Künstlerstile, 8–12 GB: SDXL.
- Poster mit Text, komplexe Szenen, 12–16 GB+: SD 3.5 Medium oder Large.
- Keine GPU: die Online-Werkzeuge dieser Seite, ohne Konto.