SDXL vs Stable Diffusion 3 vs SD 1.5: hvilken skal du bruge?

Af Opdateret 3 min. læsning

Brug Stable Diffusion 1.5 til hastighed, lavt VRAM-forbrug og et kæmpe udvalg af modeller fra fællesskabet; SDXL 1.0 til detaljerede billeder i 1024×1024 og kunstnerstile; Stable Diffusion 3.5 til prompts med flere motiver, læsbar tekst og den bedste kvalitet, hvis dit grafikkort har 12 GB eller mere.

Sammenligningstabel

SD 1.5SDXL 1.0SD 3 MediumSD 3.5 Large
Udgivetokt. 2022jul. 2023jun. 2024okt. 2024
Parametre0,9 mia.2,6 mia. (+ refiner)2 mia.8 mia.
Nativ opløsning512×5121024×10241024×10241024×1024
VRAM (fp16)4–6 GB8 GB10 GB19 GB (11 GB i fp8)
Hastighed (vores 12 GB GPU)~4 s~20 s——
Promptforståelsenøgleordnøgleord, bedre kompositionsætninger, flere motiverbedst
Tekst i billedernejsjældentja, kortja
Kunstnernavnestærk effektstærk effektsvageresvagere
Community-modellerrigtig mangeflest, med Pony og Illustriousfåfå
LicensOpenRAIL-MOpenRAIL++Community-licens (gratis under 1 mio. dollars i omsætning)
Prøv på dette webstedSD 1.5SDXLSD 3—

Stable Diffusion 1.5: arbejdshesten

Lille, hurtig og tilpasset i det uendelige. Der findes fotorealistiske finjusteringer og anime-finjusteringer, ControlNet-modeller, LoRAs og embeddings til alt. Svaghederne er grundopløsningen på 512 px, hænderne og en bogstavelig læsning af prompten. Den er stadig det rigtige valg til et kort med 6 GB, til animation med AnimateDiff og til arbejde med meget ControlNet. Medlemmernes txt2img-side på dette websted kører en tilpasset SD 1.5-model.

SDXL 1.0: detaljer og stil

SDXL har fire gange så mange pixels, en ekstra tekst-encoder og en refiner til de sidste trin. Ansigter, hænder og komposition blev markant bedre, og kunstnernavne har en stærk, forudsigelig effekt, hvilket er grunden til, at vores sammenligning af 1.731 kunstnere blev genereret med SDXL. Den kræver 8 GB og er flere gange langsommere end 1.5: cirka 20 s mod 4 s pr. billede på vores GPU. Destillerede udgaver (SDXL Turbo, LCM LoRA) nøjes med ét til otte steps i stedet for 25 til 30, mod et vist tab af kvalitet.

Stable Diffusion 3 og 3.5: forståelse og tekst

En ny arkitektur (diffusion transformer med tre tekst-encodere), der følger sætninger i stedet for nøgleordslister: "a red cube on a blue sphere, to the left of a green cone" kommer som regel rigtigt ud, og korte tekster i anførselstegn kan læses. 3 Medium havde anatomiproblemer, som 3.5 har mindsket; 3.5 Large er familiens dygtigste, 3.5 Medium den afbalancerede. Kunstnernavne og gamle vaner med negative prompts betyder mindre. Prøv Stable Diffusion 3 Medium her.

Hvilken skal du vælge?

  • Læring, kort med 6 GB, ControlNet, AnimateDiff: SD 1.5.
  • Illustration, portrætter, kunstnerstile, 8–12 GB: SDXL.
  • Plakater med tekst, komplekse scener, 12–16 GB+: SD 3.5 Medium eller Large.
  • Intet grafikkort: onlineværktøjerne på dette websted, uden konto.

Spørgsmål, andre også stiller

Er SDXL bedre end SD 1.5?

Lige ud af boksen, ja: højere opløsning, bedre anatomi og komposition. SD 1.5 beholder forspringet på hastighed og VRAM og har stadig et kæmpe bibliotek af finjusteringer fra fællesskabet.

Kan jeg bruge SD 1.5-LoRAs med SDXL eller SD 3?

Nej. Et LoRA er bundet til den arkitektur, det er trænet på; hver familie skal have sine egne LoRAs.

Hvad med Flux?

Flux.1 fra Black Forest Labs (august 2024) er en konkurrent med 12 milliarder parametre, fremragende promptfølgsomhed og tekst; Flux.2 kom i november 2025. Ingen af dem er en Stable Diffusion-model. ComfyUI kører begge, og Forge kører Flux.1, hvis fulde checkpoint fylder 24 GB; kvantiserede udgaver passer til kort med 6 til 12 GB.