본문으로 건너뛰기

Midjourney, DALL-E 3, Stable Diffusion, Flux, Leonardo AI를 위한 프롬프트 치트 시트

주요 이미지 생성 AI 모델별 최적의 프롬프트 형식과 파라미터 설정을 정리한 실전 가이드이다.

실용적 조언

  • Midjourney에서 스타일 키워드는 프롬프트의 맨 끝에 배치하여 영향력을 극대화한다.
  • Flux에서 텍스트를 생성하려면 원하는 문구를 큰따옴표로 묶어 명시한다.
  • Stable Diffusion에서는 품질 향상을 위해 (masterpiece, best quality:1.2)를 접두어로 사용한다.

섹션별 상세

01
Midjourney는 쉼표로 구분된 키워드 나열 방식을 사용하며 프롬프트 끝부분에 위치한 스타일 키워드에 더 큰 가중치를 부여한다. --ar 파라미터로 종횡비를 조절하고 --v 6.1과 같은 버전 명시를 통해 최신 모델의 성능을 끌어낼 수 있다. 30-60단어 사이의 분량이 최적이며 사이버펑크나 시네마틱 조명 같은 구체적인 미적 키워드 조합이 효과적이다.
text
cyberpunk samurai in neon rain, blade runner aesthetic, moody cinematic lighting, hyper detailed armor reflections --ar 16:9 --v 6.1

Midjourney에서 키워드 나열과 파라미터를 사용하는 예시

02
DALL-E 3는 키워드 나열보다 소설의 한 장면을 묘사하는 듯한 2-3개의 완전한 자연어 문장을 입력할 때 가장 정교한 이미지를 생성한다. 사용자의 지시사항을 매우 문자 그대로 따르는 경향이 있어 피사체의 위치나 구도를 문장으로 상세히 설명하는 것이 중요하다. 예를 들어 장인의 손동작이나 창문을 통해 들어오는 빛의 방향을 구체적으로 서술하면 의도에 가까운 결과가 도출된다.
text
A photorealistic image of an elderly Japanese craftsman carefully shaping a ceramic bowl in a traditional workshop. Warm afternoon light streams through a paper screen window, casting soft shadows. Shot at eye level with shallow depth of field, emphasizing the artisan's weathered hands.

DALL-E 3에서 자연어 문장으로 상세히 묘사하는 예시

03
Stable Diffusion은 (키워드:가중치) 문법을 통해 특정 요소의 강조 정도를 소수점 단위로 미세하게 조정할 수 있는 제어력을 제공한다. masterpiece나 best quality 같은 품질 강화 태그와 함께 원치 않는 요소를 제거하는 부정 프롬프트 활용이 필수적이다. 또한 임베딩이나 LoRA 이름을 프롬프트에 직접 포함하여 특정 화풍이나 캐릭터를 재현하는 고도의 커스터마이징이 가능하다.
text
(masterpiece, best quality:1.3), 1girl, silver hair, blue eyes, futuristic pilot suit, cockpit interior, dramatic lighting, (cyberpunk:1.2), detailed face, sharp focus

Stable Diffusion에서 가중치 문법을 사용하는 예시

04
Flux는 자연스러운 문장 구조를 이해하면서도 특히 이미지 내 텍스트 렌더링과 공간적 배치 능력에서 강점을 보인다. foreground, to the left와 같은 공간 관계 용어를 사용해 구도를 잡고 출력할 텍스트를 따옴표로 묶어 명시하면 정확한 결과물을 얻을 수 있다. 1-2개의 풍부한 문장으로 구성된 프롬프트가 모델의 일관된 구성을 유지하는 데 도움을 준다.

용어 해설

부정 프롬프트(Negative Prompt)
생성 결과물에서 제외하고 싶은 요소를 명시하는 프롬프트 기법이다. 모델이 특정 객체나 스타일을 생성하지 않도록 강제하여 결과물의 정확도를 높인다. Stable Diffusion 등에서 품질 제어를 위해 필수적으로 사용된다.
저순위 적응(LoRA)
기존 대형 모델의 가중치를 고정한 채 소규모의 추가 행렬만 학습시키는 경량화 파인튜닝 기술이다. 특정 화풍, 캐릭터, 사물을 모델에 저비용으로 학습시켜 프롬프트만으로 호출할 수 있게 한다.
종횡비(Aspect Ratio)
이미지의 가로 길이와 세로 길이 사이의 비율을 의미한다. Midjourney의 --ar 16:9와 같은 파라미터를 통해 출력물의 구도와 용도를 결정하는 핵심적인 설정값이다.
가중치 부여(Weighting)
프롬프트 내 특정 단어의 중요도를 수치로 조절하는 기법이다. (keyword:1.5)와 같은 형식을 통해 모델이 해당 요소를 더 강하게 표현하거나 약하게 표현하도록 정밀하게 제어한다.
텍스트 렌더링(Text Rendering)
이미지 생성 AI가 그림 내부에 글자를 정확하게 그려내는 능력이다. Flux와 같은 최신 모델은 따옴표 안의 텍스트를 인식하여 간판이나 문서 등에 오타 없이 문자를 삽입하는 데 특화되어 있다.

언급된 도구

Midjourney추천

예술적이고 영화 같은 이미지 생성

DALL-E 3추천

자연어 지시 기반의 정교한 이미지 생성

Stable Diffusion추천

가중치와 LoRA를 활용한 세밀한 이미지 제어

Flux추천

정확한 텍스트 렌더링과 공간 배치 특화 이미지 생성

Leonardo AI추천

스타일 프리셋을 활용한 간편한 이미지 생성

AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 04. 05.수집 2026. 04. 05.출처 타입 REDDIT

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.