AIREITER
API 문서가격
템플릿
  • AIReiter
  • 블로그
  • Qwen3.8 오픈 웨이트: 출시일, 유출 정보와 예상 포인트

Qwen3.8 오픈 웨이트: 출시일, 유출 정보와 예상 포인트

마지막 업데이트: 2026-07-29 11:14:04

Alibaba 공식 Qwen 계정은 2026년 7월 19일 X에서 Qwen3.8-Max-Preview를 발표하며 오픈 웨이트는 "coming soon"이라고만 밝혔다. 즉, 지금 체험할 수 있는 것은 내려받아 쓸 수 있는 모델이 아니라 호스팅 형태의 프리뷰다. 관심의 초점인 오픈 웨이트 공개 시점은 여전히 불명확하다. 게다가 2.4조 파라미터라는 눈에 띄는 숫자만으로는 실제 운용 비용을 판단하기 어렵고, 정작 핵심 수치는 아직 공개되지 않았다.

Qwen3.8-Max-Preview는 어떤 모델인가

Qwen3.8-Max-Preview는 Alibaba의 차기 플래그십을 미리 제공하는 호스팅형 얼리 액세스 버전이다. Alibaba의 Qwen 계정은 이를 텍스트와 이미지 등을 하나의 모델에서 다루는 완전 멀티모달 2.4조 파라미터 모델로 소개하며, Anthropic의 Claude Fable 5에만 "second only to" 한다고 설명했다.

현재 테스트는 가능하지만 경로가 제한적이다. Alibaba Cloud의 Token Plan 구독과 에이전트 플랫폼인 Qoder, QoderWork에서만 제공된다. 무료 Qwen Chat 웹 앱의 기본 모델은 여전히 이전 세대인 Qwen3.7-Plus이며, Qwen3.8이 아니다.

기본 모델로 Qwen3.8이 아닌 Qwen3.7-Plus를 표시하는 Qwen Chat 웹 앱

여기서 "Preview"라는 표기는 문자 그대로 받아들일 필요가 있다. Alibaba는 프리뷰 기간 동안 모델의 역량이 계속 바뀔 수 있다고 밝혔기 때문에, 지금의 점수나 동작 특성이 웨이트 공개 전까지 달라질 수 있다.

LMArena에서 포착된 ‘Kaleb’ 스텔스 테스트

프리뷰 발표 전에도 징후는 있었다. X의 테스터들은 Qwen3.8-Max가 LMArena 공개 모델 비교 아레나에서 "Kaleb"이라는 스텔스 코드네임으로 운영됐다고 지목했다. 연구소들은 모델에 브랜드를 붙이기 전에 익명 코드네임으로 블라인드 일대일 투표를 수집하기도 한다.

이 얘기가 중요한 이유는 프론트엔드 코드 생성 능력이 강하다는 초기 평판이 Alibaba의 마케팅이 아니라 Kaleb의 블라인드 대결에서 나왔기 때문이다. 현재로서는 가장 가까운 제3자 신호지만, Kaleb 결과를 보관해 모델 정체를 확인한 자료는 아직 없다. 따라서 증명된 사실보다는 신빙성 있는 커뮤니티 주장으로 보는 편이 맞다.

Qwen3.8 오픈 웨이트는 언제 나오나

현재 유통되는 일정은 세 가지이며, 서로 일치하지 않는다.

출처언급된 일정
Alibaba Qwen의 X 공식 게시물"Open-weight soon", 날짜 미공개
출시 당일 X 유출 게시물2026년 7월 말까지 글로벌 출시
Reddit r/Qwen_AI (파리 컨퍼런스에 참석한 Alibaba 직원의 발언을 전한 2차 정보)2026년 8월

"Soon", "7월 말", "8월"은 같은 약속이 아니다. 7월 말 주장은 출시 당일 X에 올라온 유출 게시물에서 나왔고, 8월설은 Reddit에 전해진 Alibaba 직원 발언의 2차 정보다. 셋 중 신뢰 강도가 가장 낮게 봐야 한다.

전례도 살펴볼 필요가 있다. Alibaba의 직전 Max 플래그십 두 종은 출시 첫날 오픈 웨이트로 배포되지 않았고, 이전 세대 역시 출시 후 한동안 비공개 상태였다. 프리뷰에 붙은 오픈 웨이트 약속은 약속일 뿐, 출시 자체는 아니다.

비교하면 Moonshot은 경쟁 모델 Kimi K3의 웨이트에 모호한 "soon" 대신 구체적인 날짜를 붙였다. 정확한 날짜와 하드웨어 계산은 Kimi K3 open weights 분석에서 확인할 수 있다. Qwen3.8에는 아직 이에 해당하는 확정 날짜가 없다.

2.4T보다 중요한 것은 활성 파라미터 수

"2.4조 파라미터"는 헤드라인용 숫자이지만, MoE(Mixture-of-Experts) 모델에서는 가장 실용성이 낮은 정보다. MoE는 토큰마다 전체 파라미터 중 일부만 선택해 사용하는데, 이 토큰당 "활성 파라미터" 수가 속도와 서빙 비용을 좌우한다. 총 파라미터 수만으로는 이를 거의 알 수 없다.

Alibaba는 아직 활성 파라미터 수를 발표하지 않았다. 이 수치가 없으면 모델 운용 비용, 속도, 자체 호스팅에 필요한 하드웨어를 추정할 수 없다. 총 2.4T 모델도 토큰당 활성화되는 파라미터가 수십억일 수도, 수천억에 이를 수도 있으며, 경우마다 비용 구조는 크게 달라진다.

자체 호스팅을 고려하는 사람에게는 이것이 가장 큰 공백이다. X의 한 테스터는 4비트 양자화 버전을 돌리려면 RTX 6000 Pro 여러 장이 필요할 것이라고 농담했지만, 활성 파라미터 수와 실제 웨이트 파일이 나오기 전까지는 모두 추측에 불과하다.

초기 사용자가 체감한 성능은 엇갈린다

프리뷰가 이미 열려 있는 만큼 직접 써 본 반응도 나오고 있다. 다만 벤치마크 평가와 실제 사용 경험 사이의 간극은 꽤 크다.

벤치마크 쪽에서는 커뮤니티가 공유한 KingBench 3 수치상 Qwen3.8-Max가 Opus 4.8과 Kimi K3를 앞서고, Fable 5만 그 위에 있다. X에서 @Leo_R_UK라는 이름으로 활동하는 한 개발자는 직접 API로 실행한 6개 과제 코딩 에이전트 스위트에서 60점 만점 중 59점을 기록했으며, 이는 자신이 기록한 최고 결과라고 전했다.

Claude Fable 5에 이어 Qwen3.8-Max-Preview를 2위로 표시한 커뮤니티 보고 KingBench 3 점수

다만 이 차트는 검증된 결과가 아니라 벤더 및 커뮤니티 주장으로 봐야 한다. Alibaba는 공식 벤치마크 표를 공개하지 않았으므로, 여기에 언급된 수치는 자체 주장 또는 소규모 표본으로 사용자가 돌린 평가다.

실사용 평가는 더 신중하다. X의 @synthwavedd, @VoltraceGG 등은 일상적인 에이전트 작업에서 체감 성능이 점수보다 한 단계 낮다고 말했다. 한 사용자는 벤치마크 우위와 달리 실제로는 Kimi K3보다 뒤처진다고 평했고, 다른 이들은 비공개 평가에서 Fable 5와는 "not even remotely close"한 결과가 나왔다고 전했다. 공통적으로 언급되는 점은 빠르다는 것, 때로는 지나치게 빠르게 느껴진다는 것, 프론트엔드 디자인 출력은 최전선 모델보다는 GLM-5.2 수준에 가깝다는 것이다. 웨이트가 열리고 누구나 테스트를 재현할 수 있게 된 뒤에는 이 리더보드와 실사용 간 차이를 지켜봐야 한다.

오픈 웨이트 공개를 확인하는 방법

"Soon"이 "출시 완료"로 바뀌는 순간은 추가 발표 문구가 아니라 구체적인 배포물로 확인된다. 아래 항목이 갖춰지기 전에는 Qwen3.8을 실제 개발에 쓸 수 있는 오픈 웨이트 모델로 판단하지 않는 편이 좋다.

  • 공식 다운로드 발표: 단순한 "coming soon" 게시물이 아니라 다운로드 경로를 안내하는 Alibaba/Qwen의 공식 발표.
  • 실제 웨이트 파일이 담긴 Hugging Face 리포지터리: Alibaba의 Qwen 조직 아래에 있어야 하며, 라이선스 파일도 직접 확인해야 한다. 오픈 웨이트와 오픈소스 라이선스는 같은 개념이 아니다.
  • 활성 파라미터를 명시한 모델 카드: 2.4T 총량뿐 아니라 활성 파라미터, 컨텍스트 길이, 지원 모달리티가 포함돼야 한다.
  • 제3자 벤치마크: Alibaba가 아닌 주체가 프리뷰가 아니라 공개된 웨이트로 실행한 평가 결과.
  • 안정화된 API 가격: Kimi K3와 Claude의 토큰당 비용을 비교할 수 있는 호스팅 버전의 안정적인 가격 정책.

지금 바로 개발에 사용할 모델을 고르는 중이라면, best open-source LLMs for coding 정리에서 이미 웨이트를 내려받을 수 있는 선택지를 확인할 수 있다. Qwen3.8의 웨이트와 안정적인 API가 공개되면, 다른 최전선 모델과 마찬가지로 AIReiter 같은 Anthropic 호환 API 게이트웨이를 통해서도 접근할 수 있다. 기존 연동을 다시 작성하지 않고 현재 모델과 A/B 테스트할 수 있다는 뜻이다.

FAQ

Qwen은 오픈 웨이트 모델인가?

이전 Qwen 모델 가운데 오픈 웨이트로 출시된 사례는 있지만, 공개 여부는 매번 별도로 결정된다. Qwen3.8 웨이트는 공개가 예고됐을 뿐 아직 나오지 않았다. 최근 Alibaba의 플래그십 두 종도 출시 시점에는 비공개였으므로, "Qwen은 오픈"이라는 일반화가 3.8에 자동으로 적용되지는 않는다.

Qwen3.8은 무료로 사용할 수 있나?

현재는 아니다. Qwen3.8-Max-Preview는 Alibaba Cloud의 유료 Token Plan 및 Qoder 플랫폼에서 제공된다. 무료 Qwen Chat 앱은 여전히 이전 모델인 Qwen3.7-Plus를 사용한다.

Qwen3.8이 DeepSeek나 Claude보다 뛰어난가?

커뮤니티가 보고한 KingBench 3 점수에서는 Qwen3.8-Max가 Opus 4.8을 근소하게 앞서며 Fable 5 다음에 위치한다. 그러나 이는 검증되지 않은 주장이고, 여러 테스터는 실제 에이전트 성능이 벤치마크 순위보다 낮다고 평가했다. 웨이트가 아직 공개되지 않았으므로 DeepSeek V4 또는 Claude를 상대로 한 독립적인 공개 웨이트 기준 비교도 아직 없다.

Qwen3.8 오픈 웨이트 출시일은 언제인가?

Alibaba가 공식적으로 밝힌 내용은 "soon"뿐이다. 출시 당일 유출 정보는 2026년 7월 말 출시를 가리키며, Reddit의 2차 보고는 8월을 언급한다. Alibaba가 확정한 구체적인 날짜는 없다.

>_AIReiter 모델 디렉터리

이 가이드와 관련된 모델로 빠르게 API 접근

Kimi K3

Chat

코딩, 글쓰기, 분석 및 에이전트 워크플로를 위한 장문 맥락 추론 모델입니다.

MoonshotAPI Key 생성 >

Claude Fable 5

Chat

심층 추론과 복잡한 장문 작업을 위한 프리미엄 Claude 모델입니다.

AnthropicAPI Key 생성 >

GPT-5.6 Sol

Chat

까다로운 코딩, 추론, 장문형 에이전트 작업을 위한 프리미엄 GPT-5.6 텍스트 모델.

OpenAIAPI Key 생성 >

Gemini 3.1 Pro

Chat
GoogleAPI Key 생성 >

Claude Sonnet 4.6

Chat
AnthropicAPI Key 생성 >

최근 게시글

OpenRouter Fusion Flash API: 상태, 설정, 400 오류 해결법

2026-09-11

OpenRouter Fusion 가격: 패널 규모와 토큰 비용 계산법

2026-09-11

Cursor Projects 베타 리뷰: 대규모 마이그레이션에 실제로 쓸 만할까?

2026-09-11

OpenAI Agents API 공개 베타: 가격, 샌드박스, 도입 시 주의점

2026-09-11
AIREITER

문의가 있으신가요? 연락처
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

AI 비디오

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

AI 이미지

GPT-Image 2.5Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image Turbo

블로그

모두 보기 →

회사

개인정보 처리방침서비스 약관환불 정책

© 2026 AIReiter. All rights reserved.