SDXL vs Stable Diffusion 3 vs SD 1.5: welk model moet je gebruiken?

Door Bijgewerkt op 3 min leestijd

Gebruik Stable Diffusion 1.5 voor snelheid, weinig VRAM en een enorme keuze aan community-modellen; SDXL 1.0 voor gedetailleerde afbeeldingen van 1024×1024 en kunstenaarsstijlen; Stable Diffusion 3.5 voor prompts met meerdere onderwerpen, leesbare tekst en de beste kwaliteit, als je GPU 12 GB of meer heeft.

Vergelijkingstabel

SD 1.5SDXL 1.0SD 3 MediumSD 3.5 Large
Uitgebrachtokt 2022jul 2023jun 2024okt 2024
Parameters0,9 mld2,6 mld (+ refiner)2 mld8 mld
Native grootte512×5121024×10241024×10241024×1024
VRAM (fp16)4–6 GB8 GB10 GB19 GB (11 GB in fp8)
Snelheid (onze GPU van 12 GB)~4 s~20 s——
Promptbegriptrefwoordentrefwoorden, betere compositiezinnen, meerdere onderwerpenhet beste
Tekst in beeldneezeldenja, kortja
Kunstenaarsnamensterksterkzwakkerzwakker
Community-modellenheel veelde meeste, met Pony en Illustriousweinigweinig
LicentieOpenRAIL-MOpenRAIL++Community-licentie (gratis onder 1 miljoen dollar omzet)
Proberen op deze siteSD 1.5SDXLSD 3—

Stable Diffusion 1.5: het werkpaard

Klein, snel, eindeloos aangepast. Er bestaan fotorealistische en anime-finetunes, ControlNet-modellen, LoRA's en embeddings voor alles. Zijn zwakke punten zijn de basisresolutie van 512 px, handen en een letterlijke lezing van prompts. Het blijft de juiste keuze voor een kaart met 6 GB, voor animatie met AnimateDiff en voor werk dat zwaar op ControlNet leunt. De txt2img-pagina voor leden op deze site draait een aangepast SD 1.5-model.

SDXL 1.0: detail en stijl

SDXL heeft vier keer zoveel pixels, een tweede tekstencoder en een refiner voor de laatste steps. Gezichten, handen en compositie zijn sterk verbeterd, en kunstenaarsnamen hebben een sterk, voorspelbaar effect, wat de reden is dat onze vergelijking van 1.731 kunstenaars met SDXL is gegenereerd. Het heeft 8 GB nodig en is een paar keer zo traag als 1.5: ongeveer 20 s tegenover 4 s per afbeelding op onze GPU. Gedistilleerde versies (SDXL Turbo, LCM LoRA) hebben maar één tot acht steps nodig in plaats van 25 tot 30, met enig kwaliteitsverlies.

Stable Diffusion 3 en 3.5: begrip en tekst

Een nieuwe architectuur (diffusion transformer met drie tekstencoders) die zinnen volgt in plaats van trefwoordenlijsten: "a red cube on a blue sphere, to the left of a green cone" komt er meestal goed uit en korte tekst tussen aanhalingstekens is leesbaar. 3 Medium had problemen met anatomie, die 3.5 heeft verminderd; 3.5 Large is het krachtigste model van de familie, 3.5 Medium het evenwichtige. Kunstenaarsnamen en oude gewoontes rond de negatieve prompt doen er minder toe. Probeer hier Stable Diffusion 3 Medium.

Welk model kies je?

  • Leren, kaart met 6 GB, ControlNet, AnimateDiff: SD 1.5.
  • Illustratie, portretten, kunstenaarsstijlen, 8–12 GB: SDXL.
  • Posters met tekst, complexe scènes, 12–16 GB+: SD 3.5 Medium of Large.
  • Geen GPU: de online tools op deze site, zonder account.

Veelgestelde vragen

Is SDXL beter dan SD 1.5?

Standaard wel: hogere resolutie, betere anatomie en compositie. SD 1.5 houdt het voordeel in snelheid en VRAM, en heeft nog altijd een enorme bibliotheek aan community-finetunes.

Kan ik SD 1.5-LoRA's gebruiken met SDXL of SD 3?

Nee. Een LoRA is gebonden aan de architectuur waarop hij is getraind; elke familie heeft haar eigen LoRA's nodig.

En Flux?

Flux.1 van Black Forest Labs (augustus 2024) is een concurrent met 12 miljard parameters, uitstekende promptopvolging en tekst; Flux.2 kwam in november 2025. Geen van beide is een Stable Diffusion-model. ComfyUI draait allebei en Forge draait Flux.1, waarvan het volledige checkpoint 24 GB is; gekwantiseerde versies passen op kaarten van 6 tot 12 GB.