Qwen3.8 오픈 웨이트: 출시일, 유출 정보 및 예상 사항

마지막 업데이트: 2026-07-20 03:25:26

Alibaba의 공식 X 계정인 Qwen은 2026년 7월 19일 Qwen3.8-Max-Preview를 발표하며 open weights는 날짜 없이 "coming soon"이라고 밝혔습니다. 따라서 오늘 사용해 볼 수 있는 모델은 다운로드 가능한 버전이 아니라 호스팅된 프리뷰입니다. 사람들이 실제로 기다리고 있는 것은 open-weight 릴리스이며, 현재 일정은 서로 모순되고 있고, 헤드라인에 나온 2.4조 파라미터 수치는 정말 중요한 수치를 가리고 있습니다. 확인된 세부 정보는 매우 적고, 유출된 일정은 서로 다른 세 방향을 가리키며, 실제 비용을 결정하는 단 하나의 수치는 아직 전혀 공개되지 않았습니다.

Qwen3.8-Max-Preview가 실제로 무엇인지

Qwen3.8-Max-Preview는 Alibaba의 차세대 플래그십의 호스팅된 조기 액세스 버전입니다. Alibaba의 Qwen 계정은 이를 2.4조 개의 파라미터를 가진 완전한 멀티모달 모델(텍스트, 이미지 등 여러 기능을 하나의 모델에 담은 것)로 설명하며, Anthropic의 Claude Fable 5에 "이어 두 번째"라고 포지셔닝합니다.

지금 테스트할 수 있지만, 특정 장소에서만 가능합니다: Alibaba Cloud의 Token Plan 구독과 Qoder 및 QoderWork 에이전틱 플랫폼입니다. 이는 무료 Qwen Chat 웹 앱의 기본값이 아니며, 그 앱은 여전히 이전 세대인 Qwen3.7-Plus를 불러옵니다.

Qwen Chat web app showing Qwen3.7-Plus as the default model, not Qwen3.8

"미리보기"는 여기서 문자 그대로의 경고입니다. Alibaba는 미리보기 기간 동안 모델의 기능이 계속 변할 것이라고 말하므로, 오늘 보이는 점수나 동작은 가중치가 출시되기 전에 달라질 수 있습니다.

"Kaleb" 은밀 테스트가 이를 알아차리게 했다

프리뷰는 갑자기 나온 것이 아니었습니다. 공식 공개 전에 X의 테스터들은 Qwen3.8-Max가 LMArena 공개 모델 비교 아레나에서 은밀한 코드명 "Kaleb"으로 실행되고 있다고 지적했습니다. 연구소들은 모델에 자사 브랜드를 붙이기 전에 익명 코드명을 사용해 블라인드 일대일 투표를 수집합니다.

그 세부사항이 중요한 이유는 하나입니다. 모델이 프론트엔드 코드 생성에 강하다는 초기 화제는 Alibaba의 마케팅이 아니라 그런 블라인드 Kaleb 대결에서 비롯되었기 때문입니다. 현재까지 존재하는 가장 가까운 제3자 신호이긴 하지만, 신원을 확인할 수 있도록 보관된 Kaleb 결과를 공개한 사람은 아무도 없으므로, 이를 증거라기보다는 강한 커뮤니티의 주장으로 받아들이는 것이 좋습니다.

Qwen3.8 오픈 가중치는 언제 공개되나요?

세 가지 서로 다른 일정이 돌고 있지만, 서로 일치하지 않습니다:

출처주장된 일정
Alibaba Qwen, X의 공식 게시물"곧 오픈 웨이트," 날짜 미정
X의 출시일 유출 게시물2026년 7월 말까지 전 세계 출시
Reddit r/Qwen_AI(전해 들은 내용, 파리 컨퍼런스의 Alibaba 직원)2026년 8월

"곧", "7월 말", 그리고 "8월"은 같은 약속이 아닙니다. 7월 말이라는 주장은 X의 출시일 유출 게시물에서 나온 것입니다. 8월이라는 수치는 Reddit에 보고된 Alibaba 직원의 발언에 대한 전언이며, 이 셋 중 가장 신뢰도가 낮은 것으로 봐야 합니다.

기록 문제도 있습니다. Alibaba의 가장 최근 두 개의 주력 Max 모델은 출시 첫날에 open weights를 공개하지 않았고, 이전 세대도 출시 후 한동안 closed 상태로 유지되었습니다. preview에 붙은 open-weight 약속은 약속일 뿐, release가 아닙니다.

대조적으로, Moonshot은 경쟁 제품인 Kimi K3 weights에 모호한 "soon" 대신 구체적인 달력을 날짜를 붙였습니다. 정확한 날짜와 하드웨어 계산은 우리의 Kimi K3 open weights 분석에 있습니다. Qwen3.8에는 아직 이에 상응하는 확정 날짜가 없습니다.

중요한 것은 2.4T 숫자가 아닙니다

"2.4조 파라미터"는 헤드라인 수치이지만, mixture-of-experts (MoE) 모델에서는 가장 쓸모가 적은 수치입니다. MoE 모델은 각 토큰을 전체 파라미터의 일부, 즉 토큰당 "활성 파라미터"만 통과시키므로, 전체 개수만으로는 속도나 서빙 비용에 대해 거의 아무것도 알 수 없습니다.

Alibaba는 활성 파라미터 수를 공개하지 않았습니다. 공개하기 전까지는 이 모델을 실행하는 데 얼마나 비용이 드는지, 얼마나 빠를지, 또는 자체 호스팅 복사본에 어떤 하드웨어가 필요한지 추정할 수 없습니다. 총 2.4T는 토큰당 수십억 개에서 수천억 개에 이르는 파라미터를 활성화할 수 있으며, 이러한 각 시나리오는 비용 측면에서 매우 다른 영향을 미칩니다.

자체 호스팅을 계획하는 사람에게 이것이 가장 중요한 공백입니다. X의 한 테스터는 4비트 양자화 버전을 실행하려면 여러 개의 RTX 6000 Pro 카드가 필요하다고 농담했지만, 활성 파라미터 수와 실제 가중치 파일이 존재하기 전까지는 그것은 여전히 추측에 불과합니다.

초기 테스터들이 실제로 보고 있는 것

미리보기가 라이브 상태이기 때문에, 직접적인 반응이 이미 들어왔고, 벤치마크와 실제 사용 사이에서 강하게 엇갈리고 있습니다.

벤치마크 측면에서 커뮤니티가 보고한 KingBench 3 수치에 따르면 Qwen3.8-Max는 Opus 4.8과 Kimi K3보다 앞서며, Fable 5만이 그보다 앞섰습니다. X에서 @Leo_R_UK로 게시한 한 개발자는 direct API를 통해 실행한 6개 작업 코딩 에이전트 스위트에서 59/60점을 기록했으며, 이는 그들이 기록한 최고 결과였다고 말했습니다.

Community-reported KingBench 3 scores placing Qwen3.8-Max-Preview second behind Claude Fable 5

그 차트는 검증된 것이 아니라 벤더와 커뮤니티의 주장으로 간주하세요. Alibaba는 공식 벤치마크 표를 발표한 적이 없으므로, 여기의 각 수치는 Alibaba 자체의 주장이거나 소규모 샘플에서 사용자가 직접 실행한 eval입니다.

실제 현장 보고는 더 흥미롭습니다. X의 @synthwavedd와 @VoltraceGG 같은 테스터들은 이 모델이 일상적인 agent 작업에서 점수만큼의 성능을 내지 못하는 것 같다고 말했습니다. 한 사람은 벤치마크에서는 앞서지만 실제로는 Kimi K3에 뒤처진다고 설명했고, 다른 이들은 비공개 eval을 돌려보니 Fable 5와는 "전혀 가깝지도 않게" 나왔다고 했습니다. 공통된 의견은 이렇습니다. 빠르며, 때로는 의심스러울 정도로 빠르고, frontend-design 출력은 최전선보다는 GLM-5.2 수준에 가깝다는 것입니다. 가중치가 공개되고 누구나 테스트를 재현할 수 있게 되면, 바로 이 리더보드와 체감 성능 사이의 간극을 지켜봐야 합니다.

가중치가 실제인지 확인하는 순간을 알아차리는 방법

"Soon"은 또 다른 발표가 아니라 구체적인 산출물을 통해 "shipped"로 바뀔 것입니다. Qwen3.8을 기반으로 구축할 수 있는 오픈웨이트 모델로 간주하기 전에 다음 모든 항목을 확인하세요:

  • 다운로드를 가리키는 공식 Alibaba/Qwen 출시 발표로, 단순한 "곧 출시" 게시물이 아닙니다.
  • Alibaba의 Qwen 조직 아래 실제 가중치 파일이 있는 Hugging Face 저장소와, 여러분이 읽어본 라이선스 파일(open weights와 오픈소스 라이선스는 같은 것이 아닙니다).
  • 활성 파라미터, 컨텍스트 길이, 그리고 모달리티를 나열한 model card로, 단순히 2.4T 총량만을 보여주는 것이 아닙니다.
  • Alibaba가 아닌 제3자가 수행한 벤치마크로, 프리뷰가 아니라 공개된 가중치에서 실행한 결과입니다.
  • 호스팅 버전의 안정적인 API 가격으로, 토큰당 비용을 Kimi K3 및 Claude와 비교할 수 있습니다.

오늘 사용할 모델을 선택하고 있다면, 코딩에 가장 적합한 오픈소스 LLM에 대한 우리의 정리에서 이미 가중치를 다운로드할 수 있는 옵션들을 다룹니다. Qwen3.8의 가중치와 안정적인 API가 공개되면, 다른 최첨단 모델들과 함께 AIReiter 같은 Anthropic 호환 API 게이트웨이를 통해서도 접근할 수 있게 될 것이므로, 통합을 다시 작성하지 않고도 현재 모델과 A/B 테스트를 해볼 수 있습니다.

자주 묻는 질문

Qwen은 오픈 웨이트인가요?

이전 Qwen 모델들은 오픈 가중치로 출시되었지만, 각 릴리스는 별도의 결정입니다. Qwen3.8의 가중치는 공개가 약속되었지만 아직 나오지 않았고, Alibaba의 가장 최근 두 플래그십은 출시 시점에 비공개로 유지되었으므로, "Qwen은 오픈이다"는 표현이 자동으로 3.8에 적용되지는 않습니다.

Qwen3.8은 무료로 사용할 수 있나요?

지금은 아닙니다. Qwen3.8-Max-Preview는 Alibaba Cloud의 유료 Token Plan과 Qoder 플랫폼 뒤에 있습니다. 무료 Qwen Chat 앱은 여전히 이전의 Qwen3.7-Plus를 실행합니다.

Qwen3.8가 DeepSeek나 Claude보다 더 나은가요?

커뮤니티가 보고한 KingBench 3 점수에서 Qwen3.8-Max는 Opus 4.8을 근소하게 앞서고 Fable 5 뒤에 자리합니다. 하지만 이는 검증되지 않은 주장이며, 여러 테스터들은 실제 에이전트 성능이 벤치마크 순위보다 낮다고 발견했습니다. 아직 공개된 가중치로는 DeepSeek V4나 Claude와의 독립적인 일대일 비교는 없습니다. 가중치가 공개되지 않았기 때문입니다.

Qwen3.8 오픈 가중치 출시일은 언제인가요?

알리바바는 "곧"이라고만 밝혔다. 출시일 유출 정보는 2026년 7월 말 공개를 가리키며, Reddit의 2차 정보에 따르면 8월이 유력하다. 알리바바는 아직 확정 날짜를 확인하지 않았다.