Qwen Image 3.0 출시 하루 만에 서드파티 사이트에는 이미지당 가격표가 등장했습니다. 하지만 공식 근거가 있는 가격은 아닙니다. 2026년 7월 22일 기준으로 Qwen Image 3.0은 Alibaba Cloud 공식 가격표에 아직 등록되지 않았습니다.
확인된 사실은 분명합니다. Qwen Image 3는 chat.qwen.ai에서 무료로 사용할 수 있고, API 가격은 공개되지 않았으며, 내려받을 수 있는 가중치도 없습니다(2026년 7월 22일 기준). 특히 눈에 띄는 것은 3세대 텍스트 렌더링입니다. 아래 공식 샘플처럼 아주 작은 라벨과 0.5mm 스케일 바까지 선명하게 유지합니다.

Qwen-Image-3.0 공식 예시(qwen.ai 제공). 사진을 중심으로 구성한 분류학 스타일의 플레이트이며, 작은 라벨과 0.5mm 스케일 바도 또렷하게 보입니다.
Qwen-Image-3.0을 지금 무료로 쓰는 방법
현재 확인 가능한 공식 경로는 Qwen 자체 플랫폼입니다.
Qwen Studio: chat.qwen.ai에서 웹, iOS, Android, macOS, Windows로 이용할 수 있습니다. 이미지 도구를 열고 바로 프롬프트를 입력하면 됩니다. Qwen의 공식 발표도 이 경로를 안내합니다. 7월 22일 확인 당시 무료 계정에서도 이미지 도구가 작동했지만 사용량 제한이 있었고, Qwen은 구체적인 한도를 공개하지 않았습니다.
Qwen API 플랫폼(Qwen Cloud): 3.0이 등록되면 프로그래밍 방식으로 접근할 수 있습니다. 다만 7월 22일 기준 공식 모델 가격표에 아직 없으므로, API 제공은 여전히 순차적으로 진행 중인 것으로 보는 편이 맞습니다.
이전 세대의 기술 정보는 Hugging Face의 Qwen-Image 모델 카드에서 확인할 수 있습니다.
서드파티 접근 경로에는 주의가 필요합니다. 7월 22일 Kie 마켓플레이스 카탈로그를 확인했을 때 Qwen 이미지 엔드포인트는 이전 세대인 qwen/text-to-image, qwen2/text-to-image만 제공했고 3.0 모델은 없었습니다. 이 시점에 "Qwen image 3"라고 표시한 서드파티 엔드포인트는 실제로 이전 모델로 연결될 수 있으니 의심해 볼 만합니다.
안정성도 변수입니다. 출시일인 7월 21일에는 해당 서비스의 qwen/text-to-image 엔드포인트가 작업을 접수한 뒤 반복적으로 500 오류를 반환했습니다. 한 제공업체의 장애만으로 전체 서비스 장애를 단정할 수는 없지만, 처음에는 Qwen Studio부터 사용하는 편이 나은 이유가 하나 더 생깁니다.
가격: 공식 정보와 추정치를 구분해야 한다
Qwen은 3.0의 API 요금표를 공개하지 않았습니다. 따라서 지금 Qwen Image 3의 이미지당 비용으로 제시되는 구체적인 숫자에는 공식 출처가 없습니다.
현재로서는 이전 세대가 가장 현실적인 기준점입니다. 공식 가격표에서 2.0 계열 요금은 다음과 같습니다.
모델 | 공식 가격 | 무료 할당량(싱가포르 리전) |
|---|---|---|
qwen-image-plus | 이미지당 $0.03 | 100장, 90일 |
qwen-image-2.0 | 이미지당 $0.035 | 100장, 90일 |
qwen-image-2.0-pro | 이미지당 $0.075 | 100장, 90일 |
qwen-image-max | 이미지당 $0.075 | 100장, 90일 |
3.0이 이 제품군의 가격 흐름을 따른다면 pro 티어 이상으로 책정될 가능성은 있습니다. 다만 이는 발표가 아닌 추론입니다. 실제 요금이 나오기 전까지 확실히 믿을 수 있는 비용은 Qwen Studio를 통한 무료 사용뿐입니다.
지금 도입해도 되는 경우, 기다려야 하는 경우
다음과 같은 작업이라면 지금 써볼 가치가 있습니다.
정보 밀도가 높은 레이아웃: 인포그래픽, 시험지, 포스터, 스토리보드, 여러 패널로 구성한 설명 이미지처럼 구조와 작은 글자가 살아 있어야 하는 작업입니다. 3.0이 겨냥한 핵심 영역이며, 아래 비교표의 다른 모델 중에는 이에 견줄 만한 지시문 길이를 내세우는 모델이 없습니다.
이미지 속 다국어 텍스트: 12개 언어를 실제 문자 체계로 렌더링하므로, 현지화된 이커머스 소재나 교육 콘텐츠에 유용합니다.
UI 목업과 중첩된 장면: 여러 층으로 UI를 중첩하는 데모는 제품 및 디자인 작업을 직접 겨냥하고 있습니다.
반대로 다음에 해당한다면 조금 더 기다리는 편이 좋습니다.
자체 호스팅이나 파인튜닝이 필요하다면: 2026년 7월 22일 Hugging Face 확인 기준으로 3.0 가중치는 내려받을 수 없고, 공개 계획도 발표되지 않았습니다.
프로덕션 API 파이프라인을 구축한다면: 공개된 가격, 레이트 리밋, SLA가 없는 상태라 3.0을 의존성으로 두기는 이릅니다. 현재는 2.0 계열과 Nano Banana Pro 같은 경쟁 모델이 더 적합합니다.
결과물을 계속 수정해야 한다면: 생성된 신문 지면이나 슬라이드는 결국 평면 픽셀 이미지입니다. 클라이언트가 수정 요청을 할 가능성이 있다면, 레이아웃 도구와 일반 이미지 모델을 함께 쓰는 워크플로가 여전히 안전합니다.
텍스트·레이아웃에 강한 이미지 모델과 비교하면
텍스트가 많거나 레이아웃이 복잡한 작업용 모델을 고른다면, 현실적인 대안은 아래와 같습니다. 평가는 벤치마크 점수가 아닌 방향성입니다. Qwen이 3.0의 점수를 공개하지 않았기 때문에, 모델 간 수치를 사실처럼 비교하는 것은 추측에 불과합니다.
모델 | 텍스트 렌더링 | 복잡한 레이아웃 | 편집 | 접근 방식 |
|---|---|---|---|---|
매우 강함; 10px 가독성(Qwen 기준), LaTeX급 | 매우 강함; 4.5k 토큰, 9패널 원샷 | 지원(주석, 복원) | Qwen Studio; API 대기 중 | |
Qwen-Image-2.0 | 강함 | 좋음; 약 1k 토큰 | 지원(통합) | Qwen Studio, 서드파티 엔드포인트 |
좋음 | 좋음 | 지원 | Google; 통합 API | |
좋음 | 좋음 | 지원 | ByteDance; 통합 API | |
좋음 | 좋음 | 지원 | OpenAI; 통합 API |
직접 비교할 때는 다음 세 가지를 보면, 단지 "텍스트를 넣을 수 있는" 모델과 실제로 믿고 쓸 수 있는 모델을 구분할 수 있습니다.
포스터 크기로 봐도 작은 글자가 읽히는가?
여러 패널의 구조가 섞이거나 뭉개지지 않고 유지되는가?
해당 언어의 실제 문자 체계를 유지하는가, 아니면 비슷한 문자로 흉내 내는가?
이미 AIReiter 같은 단일 API로 Nano Banana Pro, Seedream 5, GPT-Image-2를 운영하고 있다면 Qwen-Image-3.0은 아직 해당 카탈로그에 없다는 점을 알아둘 필요가 있습니다. 7월 22일 기준으로 확인 가능한 경로는 Qwen 자체 플랫폼뿐이었습니다.
Qwen Image 3.0에서 달라진 핵심
Qwen은 세대를 이렇게 설명합니다. 1.0은 "정확함", 2.0은 "정확하고, 다양하고, 완성도 높고, 아름답고, 사실적임", 3.0은 "충실함"입니다(Qwen의 한 단어 요약은 "实"). 초안용 이미지를 만드는 데서 멈추지 않고, 디자인·교육·이커머스·콘텐츠 워크플로에 바로 넣을 수 있는 결과물을 목표로 한다는 뜻입니다.
이번 릴리스는 세 가지 축으로 구성됩니다.
풍부한 콘텐츠: 4.5k 토큰 프롬프트와 복잡한 레이아웃 원샷 생성
가장 큰 변화는 프롬프트 길이입니다. Qwen-Image-3.0은 최대 4.5k 토큰의 입력을 받습니다. Qwen이 이전 세대의 지시문 길이로 언급한 약 1k 토큰에서 크게 늘어난 수치입니다. 토큰은 모델이 읽는 텍스트 조각이므로, 토큰 수가 많아질수록 한 번에 더 촘촘하고 구조적인 장면을 설명할 수 있습니다.

이 입력 여유가 가능하게 하는 것은 두 가지입니다. 첫째는 Qwen이 수평적 레이아웃이라 부르는 방식입니다. Qwen 발표문의 9패널 데모에서는 각 칸이 독립적인 상세 인포그래픽으로 구성되며, Qwen에 따르면 전체 결과가 한 번의 생성으로 나왔습니다. Qwen의 설명상 이 그리드를 온전히 기술하는 데 약 3.7k 토큰이 필요했으므로, 이전 한도로는 지시문 자체를 담을 수 없었습니다.
둘째는 깊이입니다. 인터페이스 안에 또 다른 인터페이스를 중첩하는 능력입니다. Qwen의 예시는 VS Code 창 안에 Qwen 채팅 창을, 그 안에 WeChat 채팅을, 다시 그 안에 커피 포스터를 배치하면서 각 레이어의 UI를 자연스럽게 유지합니다. 목업, 대시보드, 다층 장면을 다룬다면 주목할 만한 업그레이드입니다.
4.5k 토큰의 장점을 제대로 활용하려면 프롬프트에서 구조를 명시해야 합니다. 패널별 이름, 제목, 들어갈 정확한 텍스트를 적어 보세요. 아래는 응용할 수 있는 뼈대입니다.
Create a single 2x2 infographic poster, "Coffee Brew Methods".
Top-left — "Pour Over": 3 steps with labels (rinse filter, bloom 30s, pour in circles), small caption "1:16 ratio, 92°C".
Top-right — "French Press": labelled diagram, caption "4 min steep, coarse grind".
Bottom-left — "Espresso": cross-section of a shot with layers labelled (crema, body, heart), caption "9 bar, 25-30s".
Bottom-right — "AeroPress": numbered steps, caption "inverted method".
Consistent flat-illustration style, legible small captions, white background.사실적인 디테일: 작은 글자까지 읽히는 렌더링
텍스트 렌더링은 오랫동안 Qwen 이미지 시리즈의 강점이었고, Qwen은 3.0에서 텍스트가 10px까지 읽힌다고 주장합니다.
샘플은 까다로운 사례를 보여줍니다. 위첨자·아래첨자, 그리스 문자, 정리 번호까지 맞춘 학술 LaTeX 전체 페이지, 촘촘한 본문을 담은 신문, 그리고 이 글 상단의 연구 플레이트가 그것입니다. 특히 연구 플레이트의 주석 라벨은 썸네일 캡션 수준의 크기에서도 읽힙니다. 물론 이는 독립 테스트가 아닌 출시용으로 선별된 데모입니다. 다만 일반적으로 글자가 깨지는 크기에서 캡션, 각주, 축 라벨이 형태를 유지하는 모습은 확인할 수 있습니다.
디테일은 텍스트에만 그치지 않습니다. Qwen은 사진에 가까운 모공과 털 수준의 피부 질감, 원래의 붓 터치를 살리면서 손상된 전통 수묵화를 복원하는 편집 사례도 제시합니다.
풍부한 지식: 12개 언어, 100개 이상 스타일, 웹 연동 결과물
세 번째 축은 폭넓은 표현력입니다. Qwen-Image-3.0은 일본어·한국어·스페인어를 포함한 데모에서 12개 언어를 네이티브로 렌더링하고, 100개 이상의 아트 스타일과 여러 글꼴을 지원합니다. 웹, 게임, 라이브스트리밍용 시뮬레이션 UI도 그럴듯하게 생성합니다.

Qwen-Image-3.0 공식 예시(qwen.ai 제공). 8개 섹션과 수십 개의 작은 라벨을 한 장에 담은 지식 포스터이며, 모든 라벨이 읽힙니다.
특히 눈에 띄는 데모는 두 가지였습니다. 하나는 실제 사진을 바탕으로 분류 라벨, 형태 주석, 확대 상세 뷰, 스케일 바를 덧붙인 참고용 인포그래픽입니다. 다른 하나에서는 특정 도시와 날짜의 날씨 예보 그래픽을 만들기 위해 웹의 실시간 정보를 가져오는 모습을 보여줍니다.
둘 다 Qwen이 제작한 데모입니다. 사진 입력과 웹 검색 연동이 공개된 모든 Qwen Image 3 인터페이스에서 제공되는지는 문서화되지 않았으므로, 이를 전제로 작업을 계획하기 전에 본인이 쓰는 환경에서 지원 여부를 확인해야 합니다.
아직 공개되지 않은 정보
몇 가지 핵심 정보는 아직 나오지 않았습니다. 이를 사실처럼 단정하는 주장에는 신중할 필요가 있습니다.
API 가격: 앞서 설명했듯 7월 22일 기준 공식 정보가 없습니다. 현실적인 기준점은 2.0 계열의 가격대뿐입니다.
오픈 가중치: 이전 Qwen 이미지 모델은 다운로드할 수 있었습니다(1.0은 오픈 20B MMDiT로 출시). 그러나 Qwen은 3.0 가중치 공개 여부를 밝히지 않았고, 출시 후에도 Hugging Face에는 아무것도 올라오지 않았습니다.
파라미터 수와 벤치마크: 이번 릴리스에는 파라미터 수나 벤치마크 점수가 포함되지 않았고, 3.0은 아직 공개 텍스트-투-이미지 아레나에도 나타나지 않았습니다. 온라인에 떠도는 숫자는 대개 2.0의 정보입니다.
FAQ
Qwen Image 3는 무료인가요?
네. chat.qwen.ai의 Qwen Studio에서 무료 계정으로 이미지 도구를 쓸 수 있으며, 사용량 제한이 있습니다(2026년 7월 22일 확인). Qwen은 API 가격을 아직 공개하지 않았고, 2.0 계열의 공식 가격 범위는 이미지당 $0.03~0.075입니다.
Qwen-Image-3.0을 다운로드할 수 있나요?
아니요. 2026년 7월 22일 기준 Hugging Face에 3.0 가중치는 없으며, Qwen의 출시 글도 공개를 약속하지 않았습니다. 이전 버전은 계속 다운로드할 수 있지만, Qwen이 별도 발표하기 전까지 3.0은 클라우드 전용 모델로 보는 것이 맞습니다.
Qwen Image 3는 2.0과 무엇이 다른가요?
프롬프트 입력량이 약 1k에서 4.5k 토큰으로 늘었고, Qwen 기준 10px 크기까지 작은 글자의 가독성을 유지합니다. 12개 언어의 네이티브 텍스트 렌더링과 웹 연동 출력도 추가됐습니다. Qwen은 이를 "보기 좋은" 결과물에서 "쓸모 있는" 결과물로의 전환으로 설명합니다.
Qwen Image 3는 영어 외 텍스트도 처리하나요?
네. Qwen은 12개 언어를 네이티브로 렌더링한다고 밝혔으며, 데모에는 일본어·한국어·스페인어가 각 언어의 실제 문자 체계로 표현되어 있습니다. 비슷한 문자로 근사한 결과가 아닙니다.
온라인에서 Qwen Image 3를 어디서 사용할 수 있나요?
공식 온라인 경로는 웹과 모바일 앱을 제공하는 Qwen Studio(chat.qwen.ai)입니다. API 접근은 아직 공식 가격표에 나타나지 않았고, 확인한 서드파티 마켓플레이스에도 3.0이 없었습니다. 따라서 현재 검증된 방법은 Qwen Studio뿐입니다.