AIREITER

Qwen Image 3 Pro: 공식 API 가격·한도 검증, Pro의 차이점

마지막 업데이트: 2026-08-05 04:04:30

Qwen Image 3 Pro의 공식 API 가격은 베이징 리전 기준 1K급 이미지 1장당 ¥0.25(약 $0.035)다. 2K로 올라가면 ¥0.5로 두 배가 되며, 같은 해상도에서 일반 qwen-image-3.0보다 2.8배 비싸다. 텍스트가 빽빽한 레이아웃이라면 이 추가 비용을 납득할 여지는 있다. 다만 공식 모델 페이지의 한 숫자가 활용 계획 전체를 바꾼다. 요청 한도는 분당 1회다.

qwen-image-3.0 대비 Qwen Image 3 Pro가 다른 점

Qwen Image 3 Pro(qwen-image-3.0-pro)는 2026년 7월 21일 공개된 Alibaba의 Qwen-Image-3.0 상위 품질 모델이다. Pro와 일반 qwen-image-3.0 모두 같은 API에서 텍스트-이미지 생성과 이미지 편집을 지원하며, 이미지 크기 제한도 동일하다. 차이는 결과물 품질과 2K 출력의 과금 방식에 있다.

3.0 계열이 공통으로 내세우는 핵심 기능은 다음과 같다.

  • 4.5k 토큰 프롬프트: 이전 세대의 약 1k 토큰보다 크게 늘었다. 신문 한 페이지 전체, 3×3 인포그래픽 그리드, UI 안에 또 다른 UI가 들어가는 복합 구성을 한 번에 지시할 수 있는 수준이다.
  • 10px 텍스트 렌더링: LaTeX 수식, 위첨자, 정리 번호까지 작은 글자를 읽을 수 있게 표현하는 것을 목표로 한다.
  • 12개 언어와 20종 이상 글꼴: 여러 언어와 글꼴을 네이티브로 렌더링하며, 웹·게임·라이브스트림 인터페이스도 재현할 수 있다.
2026년 7월 21일 qwen.ai에 게시된 공식 Qwen-Image-3.0 발표

두 모델의 역할은 분명히 나뉜다. Alibaba의 모델 선택 가이드는 복잡한 레이아웃 생성, 정밀한 소형 텍스트 렌더링, 다국어 글꼴 작업에는 Pro를 권한다. 일반 모델은 품질과 속도의 균형을 맞춘 선택지로 설명한다. 그 외 사양은 두 모델 ID가 같다. 출력은 총 픽셀 기준 512×512~2048×2048, 종횡비는 1:8~8:1이며, 편집 시 참조 이미지 1~3장을 넣을 수 있고 PNG로 결과를 받는다.

공식 API 가격: 2026년 8월 검증

Alibaba Cloud Model Studio의 qwen-image-3.0-pro 이미지당 가격을 2026년 8월 5일 공식 가격표에서 확인했다. 제공 리전은 두 곳이다.

과금 항목베이징(CNY)싱가포르 국제(CNY)대략적 USD
이미지 입력(장당)¥0.02¥0.022483~$0.003
1K 출력(장당)¥0.25¥0.299768~$0.035–0.042
2K 출력(장당)¥0.5¥0.562065~$0.070–0.079

1K와 2K의 기준은 픽셀 면적이다. 2,250,000픽셀 이하는 1K 요금이 적용되고, 이를 넘으면 2K로 과금된다. 일반 qwen-image-3.0는 해상도와 무관하게 출력 이미지당 ¥0.18(약 $0.025)의 고정 요금이다. 따라서 2K에서는 Pro가 일반 모델보다 2.8배 비싸지만, 1K에서는 차이가 1.4배에 그친다.

2026년 8월 5일 캡처한 Alibaba Cloud Model Studio의 베이징 리전 qwen-image-3.0-pro 가격표 이미지당 출력 가격: qwen-image-3.0은 ¥0.18 고정, Pro는 1K ¥0.25·2K ¥0.5

놓치기 쉬운 조건도 두 가지 있다. 베이징 리전에는 활성화 후 90일 동안 유효한 무료 10장 쿼터가 제공되며, 입력과 출력을 합산한다. 직접 프롬프트로 타이포그래피 성능을 확인하기에는 충분하지만, 실제 서비스를 만들 수 있는 양은 아니다. 또 최소 한 곳의 서드파티 게이트웨이는 현재 이 모델을 무료로 표기한다. 하지만 모델 카드에는 기간 한정·쿼터 제한 체험판이라고 명시되어 있으므로, $0 표기는 가격이 아니라 데모 경로로 보는 편이 맞다.

실사용을 결정하는 분당 1회 요청 제한

공식 모델 페이지상 RPM(requests per minute)은 Pro와 일반 모델 모두 베이징·싱가포르 리전에서 1이다. 이미 자리 잡은 이미지 API가 보통 60~600 RPM을 제공하는 것과 비교하면 1~2자릿수 낮은 수준이다.

초기 사용자가 겪은 현상도 이 수치로 설명된다. 연속 호출하면 즉시 429 오류가 발생하고, 두 프로세스가 같은 키를 공유하면 두 요청 모두 실패했으며, 요청을 엄격히 직렬화하고 충분한 백오프를 둬야 안정적으로 동작했다. 공식 한도가 문서화되기 전인 7월 23일 공개된 한 테스트도 게이트웨이 경유 환경에서 정확히 같은 패턴을 측정했다.

실무적으로는 다음을 의미한다.

  • 배치 생성은 사실상 불가능하다. 키 하나당 하루 최대 약 1,440건을 순차 처리하는 것이 한계고, 버스트 여유는 없다. 요청 하나에서 n으로 최대 6장을 반환할 수 있지만 장당 과금된다.
  • 공유 키를 쓰는 팀은 서로를 제한한다. 두 개발자가 프롬프트를 반복 조정하면 충돌한다. 키를 공유해야 한다면 단일 워커 큐 뒤에 생성 요청을 배치해야 한다.
  • 재시도 루프는 상황을 악화시킨다. 연속 재호출 대신 45~60초 단위로 백오프를 설정하는 편이 낫다.

이 제한은 영구 정책이라기보다 관리형 출시 과정의 스로틀링처럼 보인다. 하지만 Alibaba가 상향하기 전까지 qwen-image-3.0-pro는 파이프라인 구성 요소가 아니라 인터랙티브 도구다.

텍스트 렌더링 성능: 잘하는 영역과 무너지는 영역

이 모델에 주목할 이유는 타이포그래피 성능이며, 독립 테스트에서도 어느 정도 확인된다. 다만 경계는 뚜렷하다. 공개된 Pro 원본 출력 테스트에서 에스프레소 머신 사양표는 약 8pt 상당의 미세한 일련번호 줄("Serial AT-2026-0731 / Made in Suzhou")까지 모든 값을 정확히 표현했고, 영중 병기 간판도 두 언어를 모두 올바르게 렌더링했다. 반면 코드 에디터 목업의 줄 번호는 1, 3, 3, 4, 6으로 나왔다. 단어와 라벨은 유지되지만, 단조 증가 수열이나 코드 연산자는 취약하다.

비교 기준을 잡기 위해 2026년 8월 5일 Nano Banana Pro(Gemini 3 Pro Image)에도 같은 사양표 프롬프트 형식을 적용했다. 가상의 AROMA-9 에스프레소 사양표에 정확한 표 값 4개와 미세한 일련번호 줄을 넣고, 기본 설정에서 재시도 없이 한 번만 생성했다. 소요 시간은 65초였다.

같은 에스프레소 사양표 프롬프트에 대한 Nano Banana Pro 출력: 표의 네 행은 모두 정확하지만 미세 문구가 "Made in Suzheu"로 표시된다

사양표 네 행은 모두 정확했지만, 미세 문구에서 도시 이름을 "Suzheu"로 잘못 썼다. 바로 Qwen이 잘 버텼다고 보고된 글자 크기 구간이다. 이미지 한 장으로 결론을 내릴 수는 없다. 다만 작은 글자 충실도는 여전히 어려운 과제이고, Qwen이 차별화 대상으로 삼은 분야라는 해석에는 들어맞는다. 커뮤니티 반응도 같은 지점에서 갈린다.

"Qwen은 체급 이상의 성능을 낸다. 텍스처 충실도와 '완성도'에서는 Gemini 3 Pro가 우위다." — r/QwenImageGen, 이전 Qwen 이미지 생성 모델과 Gemini 3 Pro Image를 비교하며

코드 스크린샷, 번호가 매겨진 축, 순차 데이터처럼 텍스트가 글자 그대로 정확해야 한다면 이 모델을 포함해 현존 이미지 모델 어느 것도 안전한 선택은 아니다.

qwen-image-3.0-pro API 호출 방법

무료로 써보려면 로그인 후 Qwen Studio에서 이미지 생성을 선택하고, 기본 모델을 3.0으로 바꾸면 된다. API는 DashScope API 키를 사용해 Alibaba Cloud Model Studio에서 호출한다. 아래 예시는 싱가포르 국제 엔드포인트 기준이다. 베이징 리전은 별도 엔드포인트와 별도 API 키가 필요하다.

curl -X POST "https://dashscope-intl.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $DASHSCOPE_API_KEY" \
  -d '{
    "model": "qwen-image-3.0-pro",
    "input": {"messages": [{"role": "user", "content": [
      {"text": "A four-row product spec table, fine print at the bottom..."}
    ]}]},
    "parameters": {"size": "1024*1536", "prompt_extend": true}
  }'

다른 이미지 API와 다른 파라미터를 공식 API 레퍼런스 기준으로 정리하면 다음과 같다.

파라미터동작 방식
sizewidth*height 형식으로 자유롭게 지정한다. 총 픽셀 면적은 512²~2048², 종횡비는 1:8~8:1 범위다. 생략하면 모델이 프롬프트를 바탕으로 해상도를 선택한다.
이미지 편집텍스트 앞에 {"image": "..."} 객체를 1~3개 전달한다. URL과 base64를 모두 지원하며 단일 턴만 가능하다.
prompt_extend프롬프트 재작성 기능이며 기본값은 켜짐이다. 텍스트-이미지에서만 agent 모드를 사용할 수 있다.
n요청당 이미지 1~6장
watermark기본값은 꺼짐
결과 URL24시간 후 만료되는 서명 URL 뒤에 PNG가 제공된다. 즉시 다운로드하고 URL 자체는 저장하지 말아야 한다.

오픈 웨이트 미제공: ‘다운로드’ 검색 결과의 정체

Qwen Image 3 Pro는 다운로드할 수 없다. Apache 2.0으로 웨이트를 공개했던 Qwen-Image 1.0과 2.0 시대의 편집 모델과 달리, 3.0 세대는 웨이트·기술 보고서·벤치마크 점수 없이 출시됐다. 팀이 공개한 최신 오픈 웨이트 체크포인트는 여전히 2025년 12월의 Qwen/Qwen-Image-2512다. ‘다운로드’를 검색하면 이 모델과 QwenLM/Qwen-Image GitHub repo가 나온다.

벤치마크 부재도 중요하다. 팀은 자체 평가 세트인 Qwen-Image-Bench를 운영하지만, 3.0 세대의 점수는 아직 공개하지 않았다. 따라서 앞서 언급한 품질 평가는 체계적 평가가 아니라 데모와 서드파티의 부분 테스트에 근거한다.

Pro 프리미엄을 내야 할까?

용도권장 선택
사양표, 포스터, 시험지, 다국어 안내문처럼 텍스트가 밀집한 레이아웃Pro: 2.8배 프리미엄의 대가가 바로 이 성능이며, 무료 10장 쿼터로 충분히 테스트할 수 있다.
일상적인 일러스트, 히어로 이미지, 반복 수정할 초안일반 qwen-image-3.0: 해상도와 무관하게 ¥0.18 고정이며, 크기 제한도 같다.
텍스트가 많은 작업의 2K 최종본Pro: 단, 장당 ¥0.5를 예산에 반영하고 2.25MP 픽셀 면적 경계를 기억해야 한다.
배치 파이프라인, 지연 시간 SLA, 무인 자동 처리둘 다 비추천: 1 RPM은 두 모델 모두를 탈락시킨다. 검증된 이미지 API를 쓰고, Qwen은 타이포그래피 우위가 필요한 경우에만 활용하는 편이 낫다.
로컬 실행Qwen-Image-2512: 최신 오픈 체크포인트다. 3.0은 웨이트가 없다.

있는 그대로 평가하면 이렇다. qwen-image-3.0-pro의 가치는 텍스트 밀도가 높은 이미지 렌더링에 있으며, 서드파티 부분 테스트에서도 그 강점은 유지된다. 그러나 1 RPM 제한은 운영 측면에서 치명적이라 전문 용도로만 적합하다. 가장 까다로운 타이포그래피 프롬프트로 무료 쿼터를 먼저 시험해 보고, 요청 한도가 오르기 전까지는 기존 프로덕션 트래픽을 현재 환경에 유지하는 편이 현실적이다.

FAQ

Qwen Image 3 Pro는 무료로 사용할 수 있나요?

부분적으로 가능하다. Qwen Studio는 로그인 후 무료 인터랙티브 사용을 제공하며, 베이징 API 리전에는 90일간 유효한 무료 이미지 10장이 포함된다. 일부 게이트웨이도 기간 한정 무료 티어를 표시하지만, 모델 카드에 쿼터 제한 체험판이라고 명시되어 있다.

qwen-image-3.0-pro를 다운로드하거나 로컬에서 실행할 수 있나요?

아니다. 3.0 세대는 웨이트를 공개하지 않았다. 최신 오픈 웨이트 Qwen 이미지 모델은 2025년 12월의 Qwen-Image-2512이며, Hugging Face에서 Apache 2.0 라이선스로 제공된다.

qwen-image-3.0-pro와 qwen-image-2.0-pro의 차이는 무엇인가요?

3.0 Pro는 프롬프트 용량을 4.5k 토큰으로 늘렸다. 2.0은 약 1k 토큰 수준이었다. 또한 10px 소형 텍스트 렌더링과 12개 언어 지원을 추가했다. 공식 가격표상 베이징 리전의 2K 요금은 두 모델 모두 ¥0.5지만, 3.0 Pro의 1K 출력은 ¥0.25인 반면 2.0 Pro는 ¥0.5 고정이다.

Qwen Image 3 Pro는 이미지 편집을 지원하나요?

지원한다. 같은 qwen-image-3.0-pro 모델 ID에 참조 이미지 1~3장과 지시문을 함께 전달해 이미지-이미지 편집을 할 수 있다. 다만 최소 한 곳의 서드파티 OpenAI 호환 게이트웨이에서는 참조 이미지 입력이 작동하지 않는다는 보고가 있으므로, 편집 기능은 먼저 네이티브 DashScope API에서 테스트하는 편이 좋다.

함께 읽기