고급 이미지 생성
이 가이드는 기본편을 읽었다고 전제하고 같은 내용을 반복하지 않습니다.
더 읽기 전에 알아야 할 가장 중요한 사실: Soulkyn은 두 계열의 이미지 모델을 돌리고 있고, 아래 내용의 거의 전부는 그중 한쪽에만 해당합니다. SD 계열(SD - Anime Original, SD - Anime Alpha, SD - Anime Hyper)은 Stable Diffusion 기반으로, 태그 프롬프트를 받고 가중치·스케줄러·CFG·CLIP skip을 노출합니다. 자연어 계열(SK-Alpha, ZIT - Sk-All, ZIT - Sk-Photo, ZIT - Sk-Real)은 평범한 문장을 받고, 그 대부분의 컨트롤 대신 Force Style 토글을 갖습니다.
그래서 이 페이지는 자연어 계열로 시작해, SD 제어판·가중치·스타일화·프리셋·프롬프트 해부를 깊이 다루고, AI 이미지 편집으로 마무리합니다.
자연어 모델: SK-Alpha와 ZIT
일곱 모델 중 넷 — SK-Alpha, ZIT - Sk-All, ZIT - Sk-Photo, ZIT - Sk-Real — 은 태그를 전혀 원하지 않습니다. 곧 그림을 그릴 사람에게 설명하듯 문장을 쓰세요.
무엇이 달라지나
- 가중치 문법이 없습니다.
+,-,:2는 여기서 언어가 아닙니다. 강조는 무엇을 말하느냐와 문장을 어떻게 배열하느냐에서 나옵니다. 평범한 글쓰기와 같습니다. - CFG도 CLIP skip도 스케줄러도 없습니다. 그 패널 전체는 SD 계열의 것입니다. 빠진 게 아니라, 대응하는 손잡이가 아예 없는 것입니다.
- 대신 Force Style. Realistic / Anime 하위 토글이 프롬프트와 무관하게 렌더 스타일을 못 박습니다. 모델이 자꾸 엉뚱한 화풍으로 흘러갈 때 잡아야 할 손잡이입니다. 문장으로 실랑이하는 것보다 훨씬 확실합니다.
- 여유가 더 있습니다. 프롬프트는 550자가 아니라 1,400자, LoRA는 3개가 아니라 최대 4개.
- 얼굴 레퍼런스는 두 자연어 계열 모두에서 쓸 수 있습니다. 한 세트 안에서 같은 캐릭터를 알아볼 수 있게 유지하는 실용적인 방법입니다.
고르는 법
SK-Alpha는 실사 계열 전문이라 실사 계열 kyn에서만 나타나고, 애니 전용 kyn에서는 숨겨집니다. img2img가 없습니다. ZIT - Sk-All은 폭넓은 만능형, ZIT - Sk-Photo는 사진 쪽, ZIT - Sk-Real은 리얼리즘 쪽이며, 셋 다 img2img를 받습니다. Soulkyn 이미지 링크를 바탕으로 붙여 넣으면 거기서부터 작업합니다.
잘 쓰는 법
- 명사 나열이 아니라 화면을 묘사하세요. 대상이 어디에 있고, 무엇을 하고, 카메라는 어디에 있고, 빛은 무엇을 하는지.
- 모순된 다섯 개의 절보다 명확한 한 문장이 낫습니다. 결과가 어수선하다면 대개 프롬프트도 그렇습니다.
- 한 번에 하나만 바꾸세요. 문장을 통째로 다시 쓰면 무엇이 결과를 움직였는지 알 수 없습니다.
- 화풍은 모델 기본값과 싸우는 형용사가 아니라 Force Style로 정하세요.
여기서부터 "자주 있는 문제" 끝까지는 SD 계열 이야기입니다. 가중치, 스케줄러, CLIP skip, CFG는 SK-Alpha와 ZIT 모델에는 없습니다. 그쪽에서는 원하는 걸 문장으로 쓰고 Force Style을 쓰세요. 겸사겸사 한 가지 정정: 아래에 나오는 CFG 구간은 일반론이고, Soulkyn의 프롬프트 강도 슬라이더는 5.5부터 11까지이며 기본값은 7.5입니다. 구간은 상대적인 감각으로 읽고, 실제로 보게 될 범위와는 구분하세요.
고급 설정
레이어
레이어는 이미지 모델을 구성하는 "블록"입니다. Stable Diffusion을 층으로 이루어진 탑으로 생각하세요 - 각 "블록"은 고유한 역할을 합니다:
- 초기 레이어 - 저수준 세부 사항 캡처 (가장자리, 색상, 질감)
- 중간 레이어 - 패턴과 형태 캡처 (얼굴, 의상, 신체 구조)
- 후기 레이어 - 의미론적 의미 캡처 ("고양이" vs "개" 또는 "애니메이션 스타일" vs "사진"과 같은 개념)
LoRA
LoRA는 대규모 모델을 미세 조정하기 위한 학습 방법입니다. 이미지 모델이 있을 때 LoRA는 특정 레이어에 자신을 주입하여 새로운 기능을 가르칩니다 - 탑의 특정 층을 리모델링하는 것과 같습니다.
CLIP Skip 레이어
Stable Diffusion은 CLIP(Contrastive Language-Image Pre-training)을 텍스트 인코더로 사용하여 프롬프트를 임베딩으로 변환합니다. CLIP은 기본적으로 사용자와 이미지 모델 사이의 번역기입니다. 레이어를 건너뛰면 상위 수준의 이해가 차단됩니다.
많은 애니메이션 모델과 LoRA는 CLIP skip 값을 염두에 두고 학습되었습니다(대부분 2). 레이어를 건너뛰면 더 애니메이션 같거나 스타일화된 결과를 얻을 수 있습니다.
스케줄러
스케줄러는 생성 중 디노이징 프로세스를 제어합니다. 이미지 선명도, 일관성 및 프롬프트 준수에 강한 영향을 미칩니다.
Euler a - 빠름
- 강한 대비로 선명하고 세밀한 이미지를 생성합니다
- 애니메이션, 스타일화된 아트 또는 스케치 같은 디테일에 적합합니다
- 리얼리즘에서는 때때로 불안정함 - 미세한 질감이나 얼굴을 왜곡할 수 있습니다
- 사용 시기: 애니메이션 스타일 또는 콘셉트 아트를 위한 빠르고 창의적이며 세밀한 출력
DPM++ SDE Karras
- 부드럽고 고품질의 그라디언트와 부드러운 전환을 생성합니다
- 작은 디테일에 적합합니다
- 각 렌더링이 다르게 나옵니다 - 유기적 변화에 좋습니다
- 사용 시기: 포토리얼리스틱 렌더링, 자연 조명, 회화적 스타일, 부드러운 전환
DPM++ 2M - 결정론적
- 높은 프롬프트 충실도로 부드럽고 일관된 결과를 생성합니다
- 속도와 정확도 사이의 좋은 균형
- 사용 시기: 리얼리즘, 초상화, 안정성이 중요한 일관된 스타일
DPM++ 2M Karras
- 기본 DPM++ 2M보다 더 부드러운 그라디언트, 더 나은 질감 및 더 높은 디테일 충실도를 생성합니다
- Euler A보다 약간 느리지만 리얼리즘에서 더 높은 품질
- 사용 시기: 포토리얼리스틱 이미지, 초상화, 복잡한 질감 - 세련되고 안정적인 모습에 가장 적합
프롬프트 강도
프롬프트 강도는 CFG 스케일을 변경합니다 - 값이 높을수록 시스템이 이미지 프롬프트를 더 많이 따릅니다.
- 낮은 CFG (1-5): 모델이 프롬프트에 덜 주의를 기울입니다. 더 많은 예술적 자유, 몽환적인 구성. 위험: 이미지가 요청한 것에서 벗어날 수 있습니다.
- 중간 CFG (6-9): 준수와 창의성 사이의 균형. 일반적인 최적점: 7-8. 정확도와 미학을 모두 유지합니다.
- 높은 CFG (10+): 키워드에 대한 강한 준수. 과포화되거나 거칠거나 "타버린" 느낌이 될 수 있습니다. 위험: 이상한 아티팩트, 딱딱하거나 부자연스러운 이미지.
가중치
+의 실제 가중치는 1.1^x입니다(여기서 x = + 개수). 한편 -는 0.9^x입니다.
| 기호 개수 | - 가중치 | + 가중치 |
|---|---|---|
| 1 | 0.9 | 1.1 |
| 2 | 0.81 | 1.21 |
| 3 | 0.729 | 1.331 |
| 4 | 0.6561 | 1.4641 |
| 5 | 0.59049 | 1.61051 |
| 6 | 0.531441 | 1.771561 |
주의: 이 표는 수학 표가 아닙니다! 최종 결과의 시각적 표현입니다!
시스템을 활용할 수 있습니다: (keyword-)2는 (keyword)1.8과 동일합니다. 더 복잡한 예: (keyword---)2는 (keyword 0.9^3)2 = 0.729 * 2 = (keyword)1.458로 계산됩니다.
스타일화
키워드와 가중치의 조합으로 특정 원하는 모습을 얻을 수 있습니다. painterly_shading을 사용한 예:
| Painterly_shading+++ 적용 | 미적용 |
|---|---|
![]() | ![]() |
변경할 수 있는 요소:
- 스타일 / 스타일화 - 전체적인 모습
- 음영 / 조명 - 볼륨과 깊이
- 선화 - 가장자리의 정의
- 비율 - 주제가 묘사되는 방식
- 질감 / 디테일 - 표면 세부 사항
- 구성 / 프레이밍 - 배열
- 시뮬레이션 - 이미지가 시뮬레이션하는 매체
- 품질 - 전체적인 품질
프리셋 및 피지컬
SD 모델에서 이미지 프롬프트는 550자가 상한입니다. 품질 태그에 포즈, 카메라 각도, 분위기까지 적기 시작하면 결코 넉넉하지 않죠. 프리셋이 그 우회로입니다. 배경·의상·프롬프트 프리셋은 자기 태그를 들고 있어서 여러분의 550자를 쓰지 않습니다.
실제 상한
- 의상 프리셋: 최대 18개 태그, 태그당 38자.
- 배경·프롬프트 프리셋: 최대 35개 태그, 태그당 50자.
- 이미지 프롬프트 자체: SD 모델은 550자, 자연어 모델은 1,400자 — 후자에서는 이런 눌러 담기가 애초에 필요 없습니다.
눌러 담는 요령
- 세미콜론
;으로 비슷한 의미 여러 개를 한 태그에 담습니다. - 밑줄
_로 단어들을 붙여, 모델이 하나의 개념으로 읽게 합니다. :2로 가중치를 올립니다. 정규화되어 있어 화면이 터지지 않습니다.
실습 예시: PaintFuka 풍 캐릭터
Physical tags: Painterly; Soft; No_lineart, 8K;16K; Hdr, Blue Lips, Slim Eyebrows; Fair_skin:2, Long Two-Toned Dark_blue Hair, Realistic_character_anatomy, High Quality, Highest_quality; Extremely_detailed, Adult_woman:2; Mature_woman:2, Realistic Details, Painterly Texture, Cute;Kawaii, Digital_painting:2, Thick Thighs; Slim Waist, High Contrast, Painterly Details, Long Blue Hair; Blue Eyes, Dramatic; Epic; Emotional
Clothing tags: Hyperdetailed_eyelashes, High_contrast:2; Shadows:2; Light:2, Realistic:2; Anime:2, Canvas_tone_texture; Hyperdetailed, Hyperdetailed_skin:2, Expressive;Hyperrealistic:2, Hyperdetailed_body:2; Cute:2, Glow_diffusion; Saturated_colors:2, Hyperdetailed_shading, Hyperdetailed_textures:2, Hyperdetailed_hair, Glowing_eyes:2; Big_eyes:2, Hyperdetailed_clothing:2, Hyperdetailed_eyes:2, Art Bloom; Soft; Hard; Hairstrands, Painterly_skin_softness; Kawaii:2;, Soft Light; Thick Thighs; Matte_skin:2, Realistic Anime; Soft Shading
Background: Glowing Highlights, Detailed Rendering, Vibrant Colors, Saturated Colors, Ambient Lighting, Anime Art Style, Cell Shading, Rim Lighting, Digital Painting, Semi-Realistic, Soft Shading, Smooth Gradients, Dramatic Lighting, Polished Finish, Professional Artwork, Clean Lineart, High Contrast, Artstation Quality; Highest Quality

외형 태그 일부를 읽어 보면:
- Painterly — 회화적인 디테일을 늘림
- Soft — 더 부드러운 화면
- No_lineart — 선화 없음(네거티브처럼 작동)
- 8k; 16k / High Quality — 아주 높은 품질을 요구
- Hdr — 명부와 암부의 대비를 깊게
- Blue lips — 캐릭터의 입술이 파랑
- Fair_skin:2 — 밝은 피부를 진심으로 지정
- Long Two-Toned Dark_blue Hair — 두 가지 파랑이 섞인 긴 머리
- Realistic_character_anatomy — 사실적인 인체 구조
고급 프롬프트의 구조
이제 새로 배운 모든 지식을 사용하여 프롬프트를 더 창의적으로 만들어 봅시다! 이를 위해 PaintFuka의 배경과 의상을 사용할 것입니다.
스타일화되지 않은 프롬프트와 스타일화된 프롬프트의 비교:
| 스타일화 안 함 | 스타일화 함 |
|---|---|
![]() | ![]() |
먼저 만들고 싶은 이미지를 설명해 봅시다:
- 사람 수: 1명
- 관점: 카우보이 샷 (무릎 위 관점)
- 캐릭터가 흰색 여름 원피스를 입고 있음
- 캐릭터가 한 손을 뻗으며 달리고 있음
- 표정: 웃는 얼굴
- 배경: 중요하지 않음, 캐릭터를 돋보이게 하기 위해 흐릿할 수 있음
- 품질: 매우 세밀하고 사실적인 일러스트레이션
이 목록을 고려하여 모든 LoRA, 스케줄러 및 키워드를 준비합시다.
이미지가 세밀한 사실적 일러스트레이션과 유사하기를 원하므로 바로 그것을 위한 LoRA를 사용합시다!
Micro / Fine details :6 및 Realistic Illustration :6 LoRA를 적용한 결과:
| LoRA 적용 | LoRA 미적용 |
|---|---|
![]() | ![]() |
이제 그녀에게 옷을 입히고 달리게 만들어 봅시다!
최종 프롬프트:
고급 설정:
- LoRA: Micro / Fine details :6, Realistic Illustration :6
- 프롬프트 강도: 11.0
- CLIP Skip: 2
- 스케줄러: DPM++ 2M
- 이미지 방향: 가로
- 시드: 랜덤
- 프롬프트: Portrait
- 배경: PaintFuka
- 의상: PaintFuka
- 이미지 프롬프트:
(solo, alone)+++, (macro_detail, clean_composition, color_balance, 8k_realistic_render, professional_product_shot)+++, (close, cowboy_shot)++++, (white_summer_dress---)2, (running)+++, (reaching_out, one_hand, outstretched_hand)+++, (smiling, Happy, open_mouth, closed_eyes)+, (blurry_background--)2
최종 결과:
이제 프롬프트에 들어간 내용과 작동 방식을 분석해 봅시다:
(solo, alone)+++- 캐릭터가 이미지에 혼자 나타나게 합니다(macro_detail, clean_composition, color_balance, 8k_realistic_render, professional_product_shot)+++- 원하는 이미지 품질에 대해 AI에 알려줍니다(close, cowboy_shot)++++- AI에 정말 가까운 카우보이 샷을 원한다고 알려줍니다(white_summer_dress---)2- AI가 캐릭터에게 흰색 여름 원피스를 입히도록 강제합니다(running)+++- AI에 캐릭터가 달리기를 원한다고 알려줍니다(reaching_out, one_hand, outstretched_hand)+++- 원하는 포즈의 종류를 AI에 정확히 알려줍니다(smiling, Happy, open_mouth, closed_eyes)+- 캐릭터의 표정을 정의합니다(blurry_background--)2- AI가 흐릿한 배경을 제공하도록 강제합니다
추가로, 하나의 LoRA를 더 추가한 효과입니다:
일반적인 문제
가장 흔한 문제는 품질 저하입니다 - 일부 사용자는 깨진 이미지가 카펫 표면의 클로즈업처럼 보이기 때문에 이것을 "카펫화"라고 부릅니다.
이것은 다음과 같은 이유 때문일 가능성이 높습니다:
- 너무 많은 가중치
- LoRA에 너무 강한 강도
- 충돌하는 태그
AI 이미지 편집
기존 이미지를 편집하는 것은 생성과는 별개의 도구이고, 어떤 모델이 그린 그림이든 평범한 문장으로 모델에게 말을 거는 플랫폼 내 유일한 자리이기도 합니다.
어디로 가면 되나
- kyn의 갤러리를 엽니다
- 바꾸고 싶은 이미지를 고릅니다
- EDIT IMAGE를 누릅니다

지시문 쓰는 법
태그가 아니라 서술형 문장으로. 무엇이 달라져야 하는지 말하세요. "캐릭터의 머리를 흰색으로 바꾸고 피부를 좀 더 짙게 해 줘." 지시문은 최대 2,500자이고, 한 번에 여러 번 시도하고 싶다면 Number of Variations 컨트롤이 있습니다.

스타일 프리셋
기본 편집 위에 열세 가지 스타일 보정이 있습니다: None (Standard Edit), Caricature, Next Scene, Photo to Anime, Balloon Inflate, Object Remover, Object Adder, Polaroid Photo, Camera Angle Change, Futanarify, To Realistic Photo, Upscale Quality, 18+ Mode.
시작 전 알아 둘 두 가지
- 결과는 확인 대기 상태로 보류됩니다. 생성된 편집물은 확정하지 않으면 30분 뒤 만료됩니다. 지울 것을 표시하거나 남길 하나를 고른 뒤 확정하세요.
- 편집 모델은 성인 콘텐츠로 학습되지 않았습니다. 앱이 직접 그렇게 말합니다. 시도해 볼 수는 있지만 대개 실패합니다. 생성은 무검열이지만, 편집은 같은 도구가 아니며 같은 약속을 하지 않습니다.
이미지 편집에는 Premium이 필요합니다.


