알리바바, 70억 파라미터 오픈웨이트 이미지 모델 '큐원-이미지-2.1' 공개
알리바바 큐원(Qwen) AI팀이 이미지 생성·편집용 오픈웨이트 모델 '큐원-이미지-2.1'을 공개했다고 더디코더(The Decoder)가 보도했다. 시각 생성 부분의 파라미터는 70억 개에 불과하지만, 큐원팀은 자체 벤치마크에서 이 모델이 대부분의 폐쇄형 모델을 앞섰다고 주장했다. 다만 독립적인 외부 벤치마크 검증은 아직 이뤄지지 않았다. 지포스 RTX 3090 수준의 고성능 소비자용 그래픽카드에서도 구동된다.
이 모델은 투명 배경 이미지(RGBA)를 자체적으로 생성하고 편집할 수 있어, 특정 사물만 분리하거나 투명 레이어 위의 텍스트를 바꾸는 작업이 가능하다. 한 번에 최대 10장의 참조 이미지를 처리해 단체 인물 사진, 가상 의상 착용, 실내 공간 디자인 등에 활용할 수 있으며, 원이나 마스크·덧칠 표시를 이용해 이미지의 일부분만 골라 수정하도록 지시할 수도 있다. 큐원팀은 구조 변경과 KV 캐시 재사용을 통해 추론 속도를 높였고, 특히 참조 이미지를 여러 장 사용할 때 효과가 크다고 설명했다.
큐원-이미지-2.1은 허깅페이스와 깃허브, 모델스코프에서 내려받을 수 있고 허깅페이스에는 체험용 데모도 마련됐다. 다만 적용된 라이선스는 연구용으로 상업적 이용을 금지하고 있어, 기업이 업무에 쓰려면 큐원 측에 별도 라이선스를 신청해야 한다.
메타브리프 편집팀