SDXL vs Stable Diffusion 3 vs SD 1.5: 어떤 모델을 써야 할까요?

작성자 업데이트 2 분 소요

VRAM이 적거나 속도와 다양한 커뮤니티 모델이 중요하면 Stable Diffusion 1.5를, 정교한 1024×1024 이미지와 아티스트 스타일을 원하면 SDXL 1.0을 쓰세요. 피사체가 여럿인 프롬프트, 읽을 수 있는 글자, 최고 품질이 필요하고 VRAM이 12GB 이상이라면 Stable Diffusion 3.5가 맞습니다.

비교표

SD 1.5SDXL 1.0SD 3 MediumSD 3.5 Large
출시2022년 10월2023년 7월2024년 6월2024년 10월
파라미터 수9억26억(+ 리파이너)20억80억
기본 해상도512×5121024×10241024×10241024×1024
VRAM(fp16)4~6GB8GB10GB19GB(fp8은 11GB)
속도(저희 12GB GPU)약 4초약 20초——
프롬프트 이해력키워드키워드, 구도 향상문장, 여러 피사체가장 우수
이미지 속 글자불가드물게 가능짧은 문구 가능가능
아티스트 이름강함강함더 약함더 약함
커뮤니티 모델매우 많음가장 많음(Pony, Illustrious 포함)적음적음
라이선스OpenRAIL-MOpenRAIL++Community Licence(연 매출 100만 달러 미만 무료)
이 사이트에서 써 보기SD 1.5SDXLSD 3—

Stable Diffusion 1.5: 든든한 주력 모델

작고 빠르며, 커뮤니티가 끝없이 커스터마이징해 온 모델입니다. 실사풍·애니풍 파인튜닝 모델, ControlNet 모델, LoRA, 임베딩까지 없는 것이 없습니다. 약점은 512px라는 기본 해상도와 손 표현, 그리고 프롬프트를 글자 그대로 받아들인다는 점입니다. 6GB 그래픽카드를 쓰거나, AnimateDiff로 애니메이션을 만들거나, ControlNet을 많이 쓰는 작업이라면 여전히 가장 알맞은 선택입니다. 이 사이트의 회원용 txt2img 페이지도 커스텀 SD 1.5 모델로 동작합니다.

SDXL 1.0: 디테일과 스타일

픽셀 수는 네 배가 되었고, 두 번째 텍스트 인코더와 마지막 스텝을 맡는 리파이너가 추가되었습니다. 얼굴, 손, 구도가 크게 좋아졌으며 아티스트 이름의 효과가 강하고 일정하게 나타납니다. 저희 아티스트 1,731명 비교를 SDXL로 생성한 것도 그래서입니다. 8GB가 필요하고 1.5보다 몇 배 느립니다. 저희 GPU에서 이미지 한 장에 1.5는 약 4초, SDXL은 약 20초가 걸립니다. 증류 버전(SDXL Turbo, LCM LoRA)을 쓰면 품질을 조금 내주는 대신 25~30스텝이 아니라 1~8스텝만으로 생성할 수 있습니다.

Stable Diffusion 3와 3.5: 이해력과 글자 표현

키워드 목록 대신 문장을 따라가는 새로운 아키텍처(텍스트 인코더 세 개를 갖춘 디퓨전 트랜스포머)입니다. "a red cube on a blue sphere, to the left of a green cone" 같은 프롬프트가 대체로 제대로 나오고, 따옴표 안의 짧은 문구도 대개 읽을 수 있게 그려집니다. 3 Medium에는 인체 표현 문제가 있었지만 3.5에서 줄었습니다. 3.5 Large는 이 계열에서 성능이 가장 뛰어난 모델이고, 3.5 Medium은 균형 잡힌 모델입니다. 아티스트 이름이나 예전 네거티브 프롬프트 습관은 덜 중요해졌습니다. Stable Diffusion 3 Medium을 여기에서 써 보세요.

어떤 모델을 골라야 할까요?

  • 입문, 6GB 그래픽카드, ControlNet, AnimateDiff: SD 1.5.
  • 일러스트, 인물, 아티스트 스타일, 8~12GB: SDXL.
  • 글자가 들어간 포스터, 복잡한 장면, 12~16GB 이상: SD 3.5 Medium 또는 Large.
  • GPU가 없을 때: 계정 없이 쓸 수 있는 이 사이트의 온라인 도구.

자주 묻는 질문

SDXL이 SD 1.5보다 좋은가요?

기본 상태로는 그렇습니다. 해상도가 더 높고 인체 표현과 구도가 낫습니다. SD 1.5는 속도와 VRAM에서 여전히 앞서고, 커뮤니티 파인튜닝 모델도 매우 많이 쌓여 있습니다.

SD 1.5용 LoRA를 SDXL이나 SD 3에서 쓸 수 있나요?

아니요. LoRA는 학습에 쓰인 아키텍처에서만 작동하므로, 계열마다 전용 LoRA가 필요합니다.

Flux는 어떤가요?

Black Forest Labs의 Flux.1(2024년 8월)은 파라미터 120억 개의 경쟁 모델로, 프롬프트를 따르는 능력과 글자 표현이 뛰어납니다. 2025년 11월에는 Flux.2가 나왔습니다. 둘 다 Stable Diffusion 모델은 아닙니다. ComfyUI에서는 두 모델 모두, Forge에서는 Flux.1을 실행할 수 있습니다. Flux.1의 전체 체크포인트는 24GB이지만, 양자화 버전은 6~12GB 그래픽카드에서도 돌아갑니다.