Qwen-Image-2.1은 2026년 9월 20일 공개된 최신 Qwen 이미지 생성 모델이다. 여러가지 이미지 편집 AI 모델들이 많이 있는데 이 모델도 매우 뛰어난 모델로 평가할 수 있다. 1. Qwen-Image-2.1 의 특징 모델의 크기가 작다. 따라서 GPU 메모리가 적어도 어느 정도 잘 생성해 준다. 이미지 생성도 이미지 편집도 함께 가능하다. 이미지 생성이나 편집시 참조 이미지 숫자가 10개 까지 가능하다. 이미지의 배경을 제거하여 투명배경 PNG 이미지를 만둘 수 있다. 문자(TEXT) 표현 능력이 뛰어나다. 특히 한글 표현 능력은 open source 모델 중에서 가장 뛰어난 능력을 보여준다. 좀 더 실사적인 이미지 생성을 해 준다. 해상도 2048x2048 이미지 생성이 가능하다. 2. 모델 사용법 Comfyui 를 최신으로 업데이트 한 후, workflow template 에서 qwen-image-2.1 을 선택하면 checkpoint model 뿐만 아니라 Text Encoder, VAE 도 모두 바로 다운받을 수 있다. 각각의 폴더에 저장한 후 이미지를 생성 및 편집을 할 수 있다. 개인적으로 다른 기능보다는 한글을 표현하는 기능이 가장 마음에 든다. 3. 다중참조이미지 사용 prompt : Apply the short hairstyle from Image 2 and the outfit from Image 3 to the person in Image 1. 참조 이미지 3개 좌로부터 Image 1. image 2. image 3. 결과 이미지 이미지 1에 이미지 2의 헤어스타일과 이미지 3의 의상을 적용 결과 4. 투명 배경이미지 생성 prompt : This is an RGBA image with transparency. A cute cartoon dragon sticker. The imag...
Hidream-O1 이미지생성 AI 모델에 대하여 사용해 본다. HiDream-O1-Image 는 HiDream.ai에서 공개한 오픈소스 기반의 차세대 이미지 생성 파운데이션 모델이다. 보통 기존 이미지 생성형 모델들은 생성모델(checkpoint), VAE, 텍스트 인코더(CLIP 등) 이 별도로 존재하여 사용했는데, 이 모델은 3가지 기능의 모델이 한 파일에 모두 합쳐져 되어있다. Hidream-O1 1. 주요 특징 독보적인 텍스트 렌더링 (Text-on-Image): 이미지 내에 길거나 복잡한 문장, 다국어(영어·중국어 등) 텍스트를 왜곡 없이 정확하게 배치해 준다. 포스터 디자인이나 타이포그래피 작업에서 현존 오픈소스 모델 중 최상위권의 성능을 낸다. One Model, Many Tasks (하나의 모델, 다양한 작업) : 텍스트에서 이미지 생성 뿐 아니라 이미지 에서 이미지 편집도 가능한 통합된 모델이다. Reasoning-Driven Prompt Agent (추론 기반 프롬프트 에이전트) : 이미지를 그리기 전에 "어떤 구도로 배치하고, 글자는 어디에 넣어야 자연스러울지" 먼저 스스로 논리적으로 추론하고 계획을 세우는 단계를 거칩니다. 덕분에 사용자가 대충 말해도 찰떡같이 이해하고 정확한 결과물을 낸다.\ Native High Resolution (네이티브 고해상도) : 업스케일 작업없이 2048x2048 이미지를 생성한다. 2. Hidream-O1 모델 설치 및 사용 이 모델을 최신 Comfyui 가 업데이트 되어 있다면 Workflow Template 에서 Hidream-O1 Full 을 선택하면 그곳에 모델과 text_encorder 를 바로 다운받을 수 있다. Hidream-O1 : ../comfyui/models/checkpoints 폴더에 설치 gemma4_e4b_it_fp8_scaled : ../comfyui/models/clip 폴더에 설치 3. 텍...