기본 콘텐츠로 건너뛰기

막강한 이미지 편집모델 - FireRed-Image-Edit-1.0

 FireRed-Image-edit이란?

FireRed-Image-edit은 텍스트 기반의 지시어(Instruction)를 통해 이미지를 편집하는 최신 LMM(Large Multimodal Model) 기반 편집 모델이다. 기존 모델들이 복잡한 편집 명령을 수행할 때 이미지의 엉뚱한 부분을 바꾸거나 화질을 저하시키는 문제를 해결하기 위해 등장했다.

개인적으로 오픈소스 중에서 이미지 편집모델은 Qwen-Image-Edit-2511 이 가장 좋았다.
그런데 이번에 출시된 FireRed-Image-Edit-1.0 버전도  상당히 마음에 드는 이미지 편집모델이다.
FireRed-Image-Edit-1.0

1. 주요 특징

  • 정교한 지시어 이해: "배경의 사과를 오렌지로 바꿔줘"와 같은 구체적인 자연어 명령어를 정확히 수행한다.
  • 내용 보존 (Content Preservation): 수정이 필요 없는 부분은 원본의 품질,질감, 조명, 구조를 그대로 유지하는 능력이 뛰어나다.
  • 멀티모달 통합: 시각 정보와 텍스트 정보를 결합하여 맥락을 파악하는 능력이 강화되었다.

2. FireRed-Image-Edit 관련 모델 다운

  • FireRed-Image-Edit-1.0_fp8_e4m3fn : " https://huggingface.co/cocorang/FireRed-Image-Edit-1.0-FP8_And_BF16/tree/main "
  • Text_Encoder : qwen_2.5_vl_7b_fp8_scaled 사용
  • VAE : qwen-image-vae 사용
  • Loras : 4steps 로 이미지를 생성하기 위하여 Qwen-Image-Edit-2511-Lightning-4steps-V1.0-bf16 Lora 를 사용

2. Workflow

    QWEN-Image-Edit 용 workflow 를 그대로 사용하여도 됨.
아래 이미지를 그대로 다운로드하여 Comfyui 에 drop 하면 workflow를 그대로 사용가능합니다.
이미지를 편집한 결과. workflow가 그대로 들어있는 png 파일

3. 이미지 편집 테스트

  • 배경 변경 
    • Prompt : The background features the Eiffel Tower in Paris, without any street and buildings behind it, and the characters blend naturally into the environment.
    • 배경만 변경

  • 의상 및 머리스타일
    • Prompt : change cloths to a cloths of image 2.  while maintaining the features of the person in the photo. messy hair.
    • 이미지 2개를 병합하여 머리스타일도 변경후 결과

  • 인물 90도 180도 회전
    • Prompt : Rotate the character's camera angle  left 90 degrees . maintain  same pose. 

    • 좌 90도 회전

    • Prompt : Rotate the character's camera angle  180 degrees . hands back , maintain  same pose.

    • 180도 회전

  • 다중 Text
    • Prompt :  input text "Wishing you a wonderful 2026, good health always, and a very Happy New Year!" in bottom of image. golden color.
    • 2026년 새해인사


  • 콜라를 들고 마시는 모습
    • Prompt : Side view of holding a can and drinking.

    • 2개의 이미지를 병합하여 캔을 들고 마시는 포즈

  • 의상 갈아입히기
    • Prompt : Dress the model in the one-piece shown in Image 1, ensuring the hem extends below the hips. Use the same style and fabric texture as displayed in Image 1. Leave the original accessories as they are, and maintain the model’s current pose.

    • 의상 교체 1.


    • 의상 교체 2.


    • 의상 교체 3.

4. FireRed-Image-Edit 의 사용결과

  • 이미지 편집속도가 빠르다.  대략 30~40초 정도 소요된다.  물론 qwen-image-edit-2511 도 60초 이내에 생성되지만  이 모델이 좀 더 빠르다.   
  • 원본 이미지의 손실이 거의 없이 원하는 부분만 잘 편집해 준다.
  • 적어도 의상 갈아입히기에서는 qwen-image-edit-2511 보다 더 잘 해준다.  
  • text는 상당히 정확하게 표현해 준다.
이 모델도 이미지 편집에 있어서는 매우 뛰어난 성능을 보여준다.
지금까지 이미지 편집에 qwen-image-edit-2511 모델을 사용해 왔는데, 이제는 이 모델로 사용해도 좋겠다는 생각이 든다.



댓글

이 블로그의 인기 게시물

Comfyui Wildcard 사용법 - Stable Diffusion , Flux 에서 쉽게 Random Prompt 로 이미지 만들기

 Comfyui Wildcard 사용법에 대하여 알아본다. Comfyui 로 Stable Diffusion 또는 Flux 로 이미지를 만들 때 Prompt 가 이미지를 결정하는데 매우 중요한 역할을 한다.  영어가 모국어가 아닌 이상 영어로 prompt 를 만드는 것이 참 어려운 일이다. 물론 처음에는 많은 다른 사람들이 사용한 prompt 들을 모방하여 수정하고 사용하는데 이런 일을 하나하나 해 보기가 시간이 많이 걸리고 어렵다.   그래서 Random 으로 prompt 가 만들어 져서 이미지가 생성되고 그 이미지 중에서 마음에 드는 이미지들을 골라 그 이미지의 Prompt들 만을 가지고 보완하고 개선하면 더 편리하고 좋지 않을까 생각이 든다.  그런 식의 Random Prompt 생성이 가능하게 해주는 것이 wildcard 사용이다. Joker는 card game에서 wildcard 이다. 1. Wildcard 의 의미      와일드 카드(Wildcard)란 카드 게임에서 유래되었다.  이런 카드 게임에서 모든 카드의 대용으로 쓸 수 있는 비장의 카드를 와일드 카드라고 한다. 포커나 훌라를 할 때 조커가 이런 역할을 하는데 ,  이 의미가 컴퓨터와 스포츠로 확장되어 사용되는 것이다. 컴퓨터 용어로 쓰일 때는 한 디렉터리 내에 여러 파일이 존재하거나, 파일 이름의 뒷부분을 정확히 알지 못하는 경우에도 사용할 수 있는 명령어를 말합니다. '*'을 넣으면 빠진 것에 어떤 문자열이 있든지 대신할 수 있고,  '?'는 임의의 한 문자에만  대응한다. Comfyui 에서 wildcard 사용은 "--문자열--"  이런 식으로 wildcard 사용 가능한 노드에 prompt 를 입력해 주면 그 노드는 "문자열" 에  해당되는 파일을 찾아 그 파일 내용 중에서 임의의 일부분을 prompt 로 대체해 준다. 2. Wildcard 사...

QWEN-Image-Edit-2509 에 얼굴 과 포즈를 적용시켜 이미지 완성하기 - Comfyui

QWEN-Image-Edit-2509 의 편집 기능은 3개의 이미지를 이용하여 다양한 이미지를 생성 할 수 있는데 그중 2개의 이미지를 적용하여 이미지를 생성해 본다. 얼굴과 포즈 적용한 이미지 하나는 인물 얼굴을, 하나는 인물의 포즈를 적용하도록 입력한다. 1. 이미지 하나 적용된 Workflow   이미지 하나 적용한 workflow 지난 포스트 중 "  QWEN-Image-Edit-2509 를 이용한 이미지 생성 팁 - Comfyui " 에서 사용된 workflow 이다.   여기에  인물의 포즈도 함께 적용해서 이미지를 생성해 볼 려고 한다. 2. 두번째 이미지 (포즈)를 적용하기 위한 workflow 이미지의 pose를 추출 두번째 이미지가 직접적으로 연결되면  포즈만 적용하는 것이 아니고 다른 것들도 적용되기 때문에 AIO Aux Preprocessor 노드를 이용하여 Pose 만을 추출하여 연결 시킨다. 3. 두개의 이미지를 연결한 완성된 Workflow 1번에 인물사진, 2번에 Pose 이미지 이 Workflow를 이용해서 원하는 인물의 얼굴과 원하는 포즈로 새로운 이미지를 생성 할 수 있다. 4. 이미지 생성 Prompt : same woman, same face, An elegant woman with a statuesque and well-proportioned figure, embodying timeless beauty and grace.  naturally long hair, She is dressed in a luxurious evening gown inspired by haute couture from Paris and Milan , with intricate embroidery, flowing silk fabrics, and a sophisticated neckline. Her accessories include a sparkling diamond neck...

Pinokio 앱 설치 - 오픈 소스 AI 플랫폼

  Pinokio 는 오픈 소스 AI 플랫폼이다. 로컬에서 AI 애플리케이션을 쉽게 설치하고 실행할 수 있게 도와주는 오픈 소스 AI 플랫폼이다. 이 플랫폼은 사용자가 복잡한 설치 과정 없이 클릭 한 번으로 AI 도구들을 설치할 수 있도록 설계되어 있다. 이를 통해 기술적인 배경 지식이 없는 초보자나 비전문가들도 쉽게 AI 애플리케이션을 사용할 수 있다.   이미 설치되어 있는 애플리케이션이 있어도 별도의 독립된 공간에서 문제없이 사용할 수 있게 해준다.   우리가 stable diffusion 을 comfyui 에서 사용하기 위해서는 "Python", "git ....", "conda"  뭔지 모르지만 설치해야 하는데 pinokio 브라우저에서 원 클릭으로 알아서 설치를 해주기 때문에  컴맹인 일반인도 쉽게 설치하고 사용 할 수 있다. pinokio.computer 1. Pinokio 주요 기능 원클릭 설치 : 복잡한 환경 설정이나 명령어 입력 없이도 다양한 AI 모델을 한 번의 클릭으로 설치할 수 있다. 예를 들어, Comfyui 나 Flux 같은 AI 도구들을 손쉽게 설치할 수 있다. 다양한 AI 애플리케이션 제공 : Pinokio는 다양한 오픈 소스 AI 애플리케이션을 제공하는 허브 역할을 하며, Pinokio 브라우저 나 홈페이지에서 쉽게 찾아 설치할 수 있다. 브라우저 기반 인터페이스 : 모든 설치된 애플리케이션은 Pinokio 웹 브라우저에서 관리할 수 있어, 친숙한 인터페이스로 쉽게 사용이 가능하다. 독립적인 가상 컴퓨터 : Pinokio는 백엔드 작업을 자동으로 처리하여, 애플리케이션이 로컬에서 실행되는 동안 인터넷에 연결되어 있지 않아도 된다. 2. Pinokio 설치 구글에서 pinokio 를 검색하여 " pinokio.computer " 를 클릭 Download 클릭 다운로드 된 pinokio 압축 파일을  푼다. pinokio 설치파일을 실행하여 설치 설치과정은 복...