라벨이 오픈 모델인 게시물 표시

Qwen-Image-2.1 사용법: 투명 PNG·다중 이미지 편집과 라이선스 확인

이미지
Qwen-Image-2.1은 2026년 9월 20일 공개된 이미지 생성·편집 모델이다. 텍스트로 새 이미지를 만드는 기능과 기존 이미지를 고치는 기능을 하나의 체크포인트에 합쳤고, 투명 배경을 포함한 RGBA 출력과 최대 10장의 참조 이미지 입력을 지원한다. 다만 “오픈 웨이트”라는 표현만 보고 업무에 바로 투입하면 안 된다. 현재 가중치는 Qwen Research License가 적용되며, 연구와 평가 목적의 비상업적 사용만 허용된다. 이 글은 모델의 특징을 나열하는 데서 끝내지 않고, ComfyUI와 Diffusers에서 준비할 파일과 입력 위치, 투명 PNG를 확인하는 방법, 다중 이미지 편집 흐름, 라이선스 때문에 실제 업무에서 멈춰야 하는 지점을 순서대로 정리한다. 기존의 영상·음성 분석 모델이 궁금하다면 Qwen3.8-Omni-Flash 활용 가이드 도 함께 볼 수 있다. 핵심부터: 무엇이 달라졌나 하나의 모델로 생성과 편집: 텍스트 투 이미지와 이미지 조건 편집을 같은 QwenImage21Pipeline에서 처리한다. 투명 배경을 모델이 직접 출력: 64채널 RGBA VAE를 사용해 알파 채널이 포함된 이미지를 만들 수 있다. 결과는 PNG처럼 알파 채널을 보존하는 형식으로 저장해야 한다. 최대 10장 참조: 인물, 제품, 의상, 배경, 스타일 자료를 여러 장 넣어 한 장면으로 조합하거나 편집할 수 있다. 부분 수정 지시: 원, 칠한 표시, 별도 마스크로 고칠 영역을 지정할 수 있다. 기본 2K 출력: 공식 Diffusers 예제는 2048×2048과 여러 가로세로 비율을 제시하며, 기본 추론 단계는 40회다. 작업 기존에 흔한 흐름 Qwen-Image-2.1 흐름 확인할 점 투명 소재 생성 후 배경 제거·매팅 RGBA 출력을 직접 요청 알파 채널과 가장자리 품질을 별도 확인 여러 자료 조합 콜라주 제작 후 다시 생성 최대 10장 참조 이미지를 입력 각 참조의 역할을 프롬프트에 명시 부분 수정...