SDXL, Stable Diffusion 3 ve SD 1.5: hangisini kullanmalısınız?

Yazan: Güncelleme: 3 dk okuma

Hız, düşük VRAM ihtiyacı ve çok geniş bir topluluk modeli seçeneği için Stable Diffusion 1.5’i, ayrıntılı 1024×1024 görseller ve sanatçı stilleri için SDXL 1.0’ı seçin. GPU’nuzda 12 GB ya da daha fazla bellek varsa birden fazla konu içeren promptlar, okunabilir yazı ve en yüksek kalite için Stable Diffusion 3.5’i kullanın.

Karşılaştırma tablosu

SD 1.5SDXL 1.0SD 3 MediumSD 3.5 Large
Çıkış tarihiEki 2022Tem 2023Haz 2024Eki 2024
Parametre sayısı0,9 milyar2,6 milyar (+ refiner)2 milyar8 milyar
Doğal çözünürlük512×5121024×10241024×10241024×1024
VRAM (fp16)4–6 GB8 GB10 GB19 GB (fp8’de 11 GB)
Hız (12 GB’lık GPU’muz)~4 sn~20 sn——
Prompt anlamaanahtar kelimeleranahtar kelimeler, daha iyi kompozisyoncümleler, birden fazla konuen iyisi
Görselde yazıyoknadirenvar, kısavar
Sanatçı adlarıgüçlügüçlüdaha zayıfdaha zayıf
Topluluk modelleripek çoken fazla, Pony ve Illustrious dahilazaz
LisansOpenRAIL-MOpenRAIL++Community Licence (gelir 1 milyon $’ın altındaysa ücretsiz)
Bu sitede deneyinSD 1.5SDXLSD 3—

Stable Diffusion 1.5: her işe koşulan emektar

Küçük, hızlı ve sayısız kez özelleştirilmiş bir model. Fotogerçekçi ve anime tarzı ince ayarlı sürümler, ControlNet modelleri, LoRA’lar ve embedding dosyaları her konu için mevcuttur. Zayıf yanları 512 piksellik temel çözünürlüğü, eller ve promptları harfi harfine yorumlamasıdır. 6 GB’lık bir kart, AnimateDiff ile animasyon ve ControlNet’in yoğun kullanıldığı işler için hâlâ doğru seçimdir. Bu sitenin üyelere özel txt2img aracı özelleştirilmiş bir SD 1.5 modeliyle çalışır.

SDXL 1.0: ayrıntı ve stil

Dört kat daha fazla piksel, ikinci bir metin kodlayıcı ve son adımlar için bir refiner. Yüzler, eller ve kompozisyon büyük ölçüde iyileşmiştir; sanatçı adlarının etkisi de güçlü ve öngörülebilirdir. 1.731 sanatçılık karşılaştırmamızı SDXL ile üretmemizin nedeni de budur. 8 GB ister ve 1.5’ten birkaç kat yavaştır: bizim GPU’muzda görsel başına 4 saniyeye karşılık yaklaşık 20 saniye. Damıtılmış sürümleri (SDXL Turbo, LCM LoRA), kaliteden bir miktar ödün vererek 25–30 adım yerine yalnızca bir ila sekiz adımla çalışır.

Stable Diffusion 3 ve 3.5: promptu anlama ve yazı

Anahtar kelime listeleri yerine cümleleri anlayan yeni bir mimari (üç metin kodlayıcılı diffusion transformer): “a red cube on a blue sphere, to the left of a green cone” çoğu zaman doğru çıkar, tırnak içindeki kısa metinler de çoğunlukla okunaklı olur. 3 Medium’un anatomi sorunları vardı, 3.5 bunları azalttı; 3.5 Large ailenin en yetenekli modelidir, 3.5 Medium ise dengeli olanıdır. Sanatçı adları ve eski negatif prompt alışkanlıkları burada daha az önem taşır. Stable Diffusion 3 Medium modelini burada deneyebilirsiniz.

Hangisini seçmelisiniz?

  • Öğrenme, 6 GB’lık kart, ControlNet, AnimateDiff: SD 1.5.
  • İllüstrasyon, portre, sanatçı stilleri, 8–12 GB: SDXL.
  • Yazı içeren afişler, karmaşık sahneler, 12–16 GB ve üzeri: SD 3.5 Medium ya da Large.
  • GPU yoksa: bu sitedeki çevrimiçi araçlar, hesap gerekmez.

Sıkça sorulan sorular

SDXL, SD 1.5’ten daha mı iyi?

Hiçbir ek ayar yapmadan, evet: daha yüksek çözünürlük, daha iyi anatomi ve kompozisyon sunar. SD 1.5 ise hızda ve VRAM ihtiyacında üstünlüğünü korur; topluluğun ürettiği ince ayarlı modellerden oluşan çok geniş bir kütüphanesi de hâlâ vardır.

SD 1.5 LoRA’larını SDXL ya da SD 3 ile kullanabilir miyim?

Hayır. Bir LoRA, üzerinde eğitildiği mimariye bağlıdır; her model ailesi için ayrı LoRA’lar gerekir.

Peki ya Flux?

Black Forest Labs’in Flux.1 modeli (Ağustos 2024), prompta uymada ve yazıda çok başarılı, 12 milyar parametreli bir rakiptir; Kasım 2025’te Flux.2 çıktı. İkisi de bir Stable Diffusion modeli değildir. ComfyUI her ikisini, Forge ise Flux.1’i çalıştırır; Flux.1’in tam checkpoint dosyası 24 GB’tır, nicemlenmiş (quantised) sürümleri ise 6 ila 12 GB’lık kartlara sığar.