Qwen Image 2.0은 Alibaba의 차세대 이미지 생성 및 편집 모델입니다. 전문 텍스트 렌더링 기능을 갖춘 단일 통합 모델로 생성과 편집을 병합합니다. 모델은 극도로 상세한 레이아웃 지침을 위해 최대 1,000 토큰 프롬프트를 지원하며 업스케일 없이 네이티브 2K 해상도(2048×2048)로 이미지를 생성합니다. 기능을 추가하면서 파라미터 수를 20B에서 7B로 줄였습니다 — 거의 3배 작고 빠릅니다.
중국어와 영어 전반의 정확한 문자 수준 렌더링. 지능적 구도, 적절한 여백, 정렬로 대량 텍스트 처리. 올바른 원근으로 표면에 적응하는 텍스트.
업스케일이 아닌 최대 2048×2048 픽셀 네이티브 생성. 피부 모공, 직물 직조, 건축 텍스처 같은 미세 디테일을 생성 중 현미경적 정밀도로 렌더링.
생성과 편집 모두를 위한 단일 모델. 텍스트 오버레이 추가, 다중 이미지 합성, 크로스 도메인 편집 처리. 텍스트 렌더링 품질이 양쪽 모두에 동등하게 이점.
20B에서 7B 파라미터로 축소 — 거의 3배 작음. 8B Qwen3-VL 인코더가 7B 확산 디코더에 공급. 품질 유지하면서 더 빠른 추론.
Qwen Image 2.0은 뛰어난 타이포그래피와 사실감으로 전문 텍스트 풍부 콘텐츠 제작에 뛰어납니다.
정확한 문자 수준 렌더링, 대량 텍스트 처리, 적절한 여백의 아름다운 구도, 사실적 표면 적응(유리, 직물, 종이), 구조화 레이아웃의 자동 정렬.
극도로 상세한 레이아웃 지침을 위해 최대 1,000 토큰 프롬프트 지원. 복잡한 사양의 완전한 인포그래픽, PPT 슬라이드, 포스터, 만화를 한 번에 생성.
중국어와 영어 텍스트 모두 뛰어난 렌더링. 적절한 문자 간격, 정렬, 시각적 구성 통합. 다양한 중국 서예 스타일 지원.
만화 캐릭터를 실제 사진에 배치, 서예 오버레이 추가, 다중 이미지 합성. 통합 모델이 일관된 품질로 다양한 편집 작업 처리.
네이티브 2K 생성이 미세 텍스처 포착: 머리카락 가닥, 직물 직조, 갈라진 땅, 숲 잎, 건축 디테일. 업스케일 아티팩트 없음.
AI Arena 블라인드 테스트에서 동일 통합 모델 사용 텍스트-이미지 및 이미지-이미지 벤치마크 모두 우수한 성능.
Qwen Image 2.0은 전문 텍스트 풍부 콘텐츠와 사실적 장면에 뛰어납니다.
전문 텍스트 풍부 콘텐츠와 사실적 이미지를 만듭니다:
레이아웃 사양이 포함된 최대 1,000 토큰의 상세 프롬프트 제공. 전문 타이포그래피로 인포그래픽, 포스터, 만화, 사실적 장면 생성.
텍스트 지침으로 기존 이미지 편집. 서예를 포함한 텍스트 오버레이 추가, 다중 이미지 합성, 크로스 도메인 편집 작업 처리.
자동 텍스트 정렬로 PPT 슬라이드, 달력, 데이터 차트, 구조화 레이아웃 생성. 모델이 여백 영역에 텍스트를 지능적으로 배치.
중국어와 영어 텍스트가 있는 콘텐츠 생성. 모델이 문자 수준 렌더링, 적절한 간격, 두 언어의 문화적 타이포그래피 관습 처리.
Qwen Image 2.0 AI 이미지 생성 모델에 대한 일반적인 질문.