기본 콘텐츠로 건너뛰기

글

라벨이 QWEN인 게시물 표시

막강한 이미지 편집모델 - FireRed-Image-Edit-1.0

 FireRed-Image-edit이란? FireRed-Image-edit은 텍스트 기반의 지시어(Instruction)를 통해 이미지를 편집하는 최신 LMM (Large Multimodal Model) 기반 편집 모델이다. 기존 모델들이 복잡한 편집 명령을 수행할 때 이미지의 엉뚱한 부분을 바꾸거나 화질을 저하시키는 문제를 해결하기 위해 등장했다. 개인적으로 오픈소스 중에서 이미지 편집모델은 Qwen-Image-Edit-2511 이 가장 좋았다. 그런데 이번에 출시된 FireRed-Image-Edit -1.0 버전도  상당히 마음에 드는 이미지 편집모델이다. FireRed-Image-Edit-1.0 1. 주요 특징 정교한 지시어 이해: "배경의 사과를 오렌지로 바꿔줘"와 같은 구체적인 자연어 명령어를 정확히 수행한다. 내용 보존 ( Content Preservation ): 수정이 필요 없는 부분은 원본의 품질,질감, 조명, 구조를 그대로 유지하는 능력이 뛰어나다. 멀티모달 통합: 시각 정보와 텍스트 정보를 결합하여 맥락을 파악하는 능력이 강화되었다. 2. FireRed-Image-Edit 관련 모델 다운 FireRed-Image-Edit-1.0_fp8_e4m3fn : " https://huggingface.co/cocorang/FireRed-Image-Edit-1.0-FP8_And_BF16/tree/main " Text_Encoder :  qwen_2.5_vl_7b_fp8_scaled 사용 VAE : qwen-image-vae 사용 Loras : 4steps 로 이미지를 생성하기 위하여 Qwen-Image-Edit-2511-Lightning-4steps-V1.0-bf16 Lora 를 사용 2. Workflow     QWEN-Image-Edit 용 workflow 를 그대로 사용하여도 됨. 아래 이미지를 그대로 다운로드하여 Comfyui 에 drop 하면 workflow를 그대로 사용가능합...

FLUX.2-Klein 모델 : 오픈소스 이미지 편집 모델

 FLUX.2-Klein 모델 은 Black Forest Labs 사에서 만든  오픈소스 이미지 편집 모델이다. Flux1 에서도 이미지 편집 모델이 있었다.  Flux-Kontext 모델이 였는데,  이번에 Flux2 에서도 Flux2-Klein 모델이 출시되었다. 이번 포스팅에서는 이 모델을 사용해보고 특징을 알아보고자 한다. 참고로 Qwen-Image 편집모델은 아래 포스팅을 참조하기를 바란다. (  막강한 이미지 편집 모델 - QWEN-Image-Edit-2511  )  Flux2-klein 모델로 텍스트를 편집한 이미지 1. Flux2-Klein 의 특징 뛰어난 품질로 1초 미만의 이미지 생성을 위한 간소화된 모델. flux-2-klein-9b-fp8 : 9.4G flux-2-klein-base-4b-fp8 : 4.0G flux-2-klein-distilled-4b-fp8 : 3.8G base-4b 모델을 사용결과 대략 30steps 에 55초 정도 소요 (그래픽카드 4070ti, 16G 일때) 이다.  distilled-4b 모델은 10초 소요, 1초라는 것은  5090 이상에서 distilled 버전을 사용 (4 steps) 했을 경우이다.  이 모델은 Qwen 보다는 크기가 작다. 텍스트-이미지 및 이미지-이미지 다중 참조 편집을 하나의 통합 모델로 제공합니다.  프롬프트의 가독성이 뛰어나다. 영어 뿐만 아니라 한글 프롬프트도 인식하여 생성한다. Text 는 정확하게 잘 써진다. 다만 영어 만......  2. Flux2-klein-base-4b 사용방법     여기서는 Comfyui 를 이용하여 사용하는 방법이다. 모델 다운로드 설치 : Comfyui 홈페이지에 ( https://docs.comfy.org/tutorials/flux/flux-2-klein ) 에 가면 Flux2-klein-base-4b 뿐 만 ...

QWEN-Image-Edit-2509 에 얼굴 과 포즈를 적용시켜 이미지 완성하기 - Comfyui

QWEN-Image-Edit-2509 의 편집 기능은 3개의 이미지를 이용하여 다양한 이미지를 생성 할 수 있는데 그중 2개의 이미지를 적용하여 이미지를 생성해 본다. 얼굴과 포즈 적용한 이미지 하나는 인물 얼굴을, 하나는 인물의 포즈를 적용하도록 입력한다. 1. 이미지 하나 적용된 Workflow   이미지 하나 적용한 workflow 지난 포스트 중 "  QWEN-Image-Edit-2509 를 이용한 이미지 생성 팁 - Comfyui " 에서 사용된 workflow 이다.   여기에  인물의 포즈도 함께 적용해서 이미지를 생성해 볼 려고 한다. 2. 두번째 이미지 (포즈)를 적용하기 위한 workflow 이미지의 pose를 추출 두번째 이미지가 직접적으로 연결되면  포즈만 적용하는 것이 아니고 다른 것들도 적용되기 때문에 AIO Aux Preprocessor 노드를 이용하여 Pose 만을 추출하여 연결 시킨다. 3. 두개의 이미지를 연결한 완성된 Workflow 1번에 인물사진, 2번에 Pose 이미지 이 Workflow를 이용해서 원하는 인물의 얼굴과 원하는 포즈로 새로운 이미지를 생성 할 수 있다. 4. 이미지 생성 Prompt : same woman, same face, An elegant woman with a statuesque and well-proportioned figure, embodying timeless beauty and grace.  naturally long hair, She is dressed in a luxurious evening gown inspired by haute couture from Paris and Milan , with intricate embroidery, flowing silk fabrics, and a sophisticated neckline. Her accessories include a sparkling diamond neck...

QWEN-Image-Edit-2509 를 이용한 이미지 생성 팁 - Comfyui

QWEN-Image-Edit-2509 모델은 사용하면 할 수록 유용한 이미지 편집 모델이다. Flux 나 QWEN 모델을 이용하여 이미지를 생성할 때 , 특히 여성 인물 이미지를 만들 때 주로 내가 원하는 여성 상을 만들기 위하여 lora 모델을 사용한다. QWEN-Image-Edit-2509 모델은 주로 이미지 편집에 사용하는데 종종 내가 원하는 여성 인물 이미지를 일관성 있게 만들 때도 사용하고 있다.  어찌 보면 이미지 편집의 하나라고 생각 할 수도 있지만 생성된 이미지에서 동일한 얼굴의 여성을 사용할 뿐 의상이나 배경 포즈 모두가 다른 것이기 때문에 lora 모델을 이용하여 이미지를 생성하는 것과 유사한 효과를 나타낸다. QWEN-Image-Edit-2509 1. Workflow GGUF 모델 사용 workflow workflow 는 Flux 나 QWEN 을 사용하는 것 처럼 간단하게 만들 수있다. 다만, Load Image 와 이것을 이용하여 Prompt 를 만들어줄  TextEncodeQwenImageEditPlus  노드가 필요하다. 만약 이미지가 불필요하면 Load Image 를 Pass 시킨 후 이미지를 생성하면된다. 2. Load Image 여기에는 일관성 있게 내가 원하는 인물의 사진이면 된다. 위의 그림처럼 얼굴만 나와도 되고 전신이 나온 사진이여도 된다. TextEncodeQwenImageEditPlus 노드에는 3개의 Image 를 연결 사용할 수 있지만 여기서는 단순히 동일 인물 이미지를 만들기 위해서 하나의 이미지 만 연결하여 사용하였다. 3. 얼굴사진을 이용한 일관된 이미지 생성 결과 얼굴만 나온 사진 Prompt : same woman, same face, a stylish maroon halter top designed for a feminine silhouette. The top includes a high neckline adorned with intricate embellishments, inc...

한복이미지를 아주 잘 만들어 주는 QWEN - 한복, 동양화, 전통 한식 등

 한복을 입은 한국여성의 이미지를 생성하기 위하여 프롬프트를 만들어 실행을 해도 우리가 원하는 그런 이미지를 얻기가 참 어려웠다. 대부분의 Diffusion Model 들(Stable diffusion, SD3, Flux 등)은 보통 Traditional korean style 라고 해도 중국 풍과 일본풍이 섞여진 별로 전통한국 스타일이 아닌 이미지를 만들어준다. 이것을 해결하기 위하여 보통 사용하는 방법이 한복 또는 한국화 관련 Lora 를 적용하여 만들고 있다. 전통사극에서 볼수있는 궁중 복식 그런데 QWEN 모델은 프롬프트로 한글을 잘 인식할 뿐만 아니라 한복을 입은 여성의 이미지도 아주 잘 생성해 준다.   안타깝지만 생성형 이미지 모델을 우리나라에서 출시된 모델은 없기 때문에 한복이미지도 포기 상태였는데 중국에서 만든 QWEN 모델이 잘 만들어 주기 때문에 중국도 역시 같은 동 아시아권의 이웃 국가가 맞다는 생각을 하게 된다. QWEN 을 이용하여 전통 한국 이미지를 만들어 본다. 1. 한복을 입은 아름다운 한국여성 프롬프트 : 전통 한복을 입은 젊은 여성이 키 크고 흔들리는 황금빛 풀밭에 서 있는 사실적인 디지털 페인팅입니다. 검은 머리카락은 깔끔하게 정돈되어 있으며, 올린 머리에 몇 가닥의 느슨한 머리카락이 얼굴을 감싸고 있습니다. 그녀의 표정은 차분하고 사색에 잠긴 듯하며, 오른손은 부드럽게 가슴에 손을 얹고 있습니다. 그녀는 미묘한 질감의 흰색 저고리와 짙은 청록색 치마를 입고 있으며, 허리에는 풍성하고 흐르는 듯한 짙은 적갈색 리본이 묶여 있습니다. 배경에는 밝고 맑은 푸른 하늘과 옅은 구름이 몇 개 떠 있고, 두 마리의 화려한 나비가 근처에서 날아다닙니다. 분홍색 꽃잎이 공중에 떠다니며 장면에 부드러움을 더합니다. 전체적인 구도는 고요함과 우아함을 발산하며, 전통적인 아름다움과 자연과의 평화로운 조화를 모두 포착합니다. 흰색저고리, 청록색 치마,  올린머리 한국의 전통 한복이 맞다.  이 프롬프트를...