Qwen3.8 Open Weights: Çıkış Tarihi, Sızıntılar ve Beklentiler

Son Güncelleme: 2026-07-20 03:24:43

Alibaba'nın X üzerindeki resmi Qwen hesabı, 19 Temmuz 2026'da Qwen3.8-Max-Preview'u duyurdu ve açık ağırlıkların bir tarih vermeden "yakında geliyor" olduğunu söyledi. Yani bugün deneyebileceğiniz model, indirilebilir bir sürüm değil, barındırılan bir önizlemedir. Açık ağırlık sürümü, insanların aslında beklediği şeydir ve şu anda zaman çizelgesi birbiriyle çelişiyor; ayrıca manşetteki 2,4 trilyon parametre rakamı önemli olan sayıyı gizliyor. Doğrulanmış ayrıntılar az, sızdırılan zaman çizelgesi üç farklı yönü işaret ediyor ve gerçek dünya maliyetini belirleyen tek sayı ise henüz hiç yayımlanmadı.

Qwen3.8-Max-Preview tam olarak nedir

Qwen3.8-Max-Preview, Alibaba'nın bir sonraki amiral gemisinin barındırılan, erken erişim sürümüdür. Alibaba'nın Qwen hesabı, onu 2,4 trilyon parametreli, tam multimodal bir model (metin, görüntü ve daha fazlasını tek bir modelde) olarak tanımlıyor ve bunu Anthropic'in Claude Fable 5'inin "yalnızca ardından gelen" modeli olarak konumlandırıyor.

Bunu şimdi test edebilirsiniz, ancak yalnızca belirli yerlerde: Alibaba Cloud'un Token Plan aboneliği ve Qoder ile QoderWork ajan tabanlı platformlarında. Bu, ücretsiz Qwen Chat web uygulamasında varsayılan değildir; orada hâlâ önceki nesil olan Qwen3.7-Plus yüklenir.

Qwen Chat web app showing Qwen3.7-Plus as the default model, not Qwen3.8

"Önizleme" burada kelimesi kelimesine bir uyarıdır. Alibaba, önizleme dönemi boyunca modelin yeteneklerinin değişmeye devam edeceğini söylüyor; bu nedenle bugün gördüğünüz herhangi bir puan veya davranış, ağırlıklar yayınlanmadan önce değişebilir.

"Kaleb" gizlilik testinin bunu ele vermesi

Önizleme birdenbire ortaya çıkmadı. Resmi tanıtımdan önce, X'teki test kullanıcıları Qwen3.8-Max'in LMArena herkese açık model karşılaştırma arenasında "Kaleb" gizli kod adıyla çalıştığını fark etti. Laboratuvarlar, markalarını bir modele iliştirmeden önce kör bire bir oylama toplamak için anonim kod adları kullanır.

Bu ayrıntı tek bir nedenle önemlidir: modelin frontend kod üretiminde güçlü olduğuna dair erken heyecan, Alibaba'nın pazarlamasından değil, o kör Kaleb karşılaşmalarından kaynaklanıyor. Şimdilik mevcut olan en yakın üçüncü taraf sinyali bu, ancak kimliği doğrulamak için arşivlenmiş bir Kaleb sonucu kimse yayımlamadı; bu yüzden bunu kanıt yerine güçlü bir topluluk iddiası olarak değerlendirin.

Qwen3.8 açık ağırlıkları ne zaman çıkıyor?

Üç farklı zaman çizelgesi dolaşıyor ve birbiriyle uyuşmuyor:

Kaynakİddia edilen zaman çizelgesi
Alibaba Qwen, X'te resmi gönderi"Open-weight soon," tarih yok
X'te lansman günü sızıntı gönderileriTemmuz 2026 sonuna kadar küresel kullanıma sunulma
Reddit r/Qwen_AI (ikinci el, Paris'teki bir konferansta Alibaba çalışanı)Ağustos 2026

"Yakında", "Temmuz sonu" ve "Ağustos" aynı vaat değildir. Temmuz sonu iddiası, X’teki lansman günü sızıntı paylaşımlarından geliyor. Ağustos ifadesi ise Reddit’te aktarılan bir Alibaba çalışanının yorumuna dair ikinci el bir anlatımdır ve bu üçü arasında en temkinli olanı olarak değerlendirilmelidir.

Ayrıca bir geçmiş performans sorunu da var. Alibaba’nın en son iki amiral gemisi Max modeli ilk günde açık ağırlıklarla yayınlanmadı ve önceki nesil de lansmandan sonra bir süre kapalı kaldı. Bir ön izlemeye eklenen açık ağırlık vaadi, bir sürüm değil, bir vaattir.

Karşılaştırma için, Moonshot rakip Kimi K3 ağırlıklarına belirsiz bir “yakında” yerine belirli bir takvim tarihi ekledi. Tam tarih ve donanım hesabı, Kimi K3 açık ağırlıkları incelememizde yer alıyor. Qwen3.8 için henüz buna eşdeğer kesin bir tarih yok.

Önemli olan 2,4T sayısı değil

"2,4 trilyon parametre" manşet rakamıdır, ancak bir mixture-of-experts (MoE) modeli için en az faydalı olanıdır. MoE modelleri her token'ı toplam parametrelerinin yalnızca bir kısmından geçirir, token başına "aktif parametreler" üzerinden çalışır; bu yüzden toplam sayı size hız veya servis maliyeti hakkında neredeyse hiçbir şey söylemez.

Alibaba etkin parametre sayısını yayınlamadı. Bunu yapana kadar, modelin çalıştırılmasının ne kadar pahalı olacağını, ne kadar hızlı olacağını veya kendi barındırdığınız bir kopyanın hangi donanıma ihtiyaç duyacağını tahmin edemezsiniz. Toplam 2.4T, token başına onlarca milyardan birkaç yüz milyar parametreye kadar herhangi bir yerde etkinleşebilir ve bu senaryoların her birinin maliyet etkileri çok farklıdır.

Bu, self-host etmeyi planlayan herkes için en önemli eksikliktir. X’te bir test kullanıcısı, 4-bit quantize edilmiş bir sürümü çalıştırmak için birkaç RTX 6000 Pro karta ihtiyaç duyulacağından şaka yollu bahsetti ve aktif parametre sayısı ile gerçek ağırlık dosyaları mevcut olana kadar bu yalnızca bir tahmin olarak kalır.

Erken test kullanıcılarının gerçekte gördüğü şey

Önizleme canlı olduğu için, ilk elden tepkiler şimdiden geldi ve bunlar benchmarklar ile gerçek kullanım arasında keskin biçimde bölündü.

Benchmark tarafında, topluluk tarafından bildirilen KingBench 3 sonuçları Qwen3.8-Max’ı Opus 4.8 ve Kimi K3’ün üstüne koyuyor; yalnızca Fable 5 önde. X’te @Leo_R_UK olarak paylaşım yapan bir geliştirici, doğrudan API üzerinden çalıştırılan altı görevli bir kodlama ajanı paketinin 59/60 aldığını ve bunun kaydettikleri en yüksek sonuç olduğunu söyledi.

Community-reported KingBench 3 scores placing Qwen3.8-Max-Preview second behind Claude Fable 5

Bu grafiği doğrulanmış değil, satıcı ve topluluk tarafından iddia edilmiş olarak değerlendirin. Alibaba, resmi bir benchmark tablosu yayımlamadı; bu yüzden burada yer alan her sayı ya kendi iddiasıdır ya da küçük bir örneklem üzerinde kullanıcı tarafından yapılan bir değerlendirmedir.

Gerçek dünya raporları daha da ilginç. @synthwavedd ve X’teki @VoltraceGG gibi testçiler, modelin günlük ajan işlerinde puanlarının bir kademe altında hissettirdiğini söyledi. Biri, benchmark avantajına rağmen pratikte Kimi K3’ün gerisinde kaldığını anlatırken, başkaları özel değerlendirmeler yapıp modelin Fable 5’e "hiç de yakın olmadığını" gördü. Ortak bir not: hızlı, bazen şüphe uyandıracak kadar hızlı ve frontend tasarım çıktısı, en uç noktada olmaktan ziyade GLM-5.2 seviyelerinde. Ağırlıklar açıldığında ve herkes testleri yeniden yapabildiğinde dikkat edilmesi gereken şey de tam olarak bu leaderboard ile deneyim arasındaki fark.

Ağırlıkların gerçek olduğu an nasıl anlaşılır

"Soon" somut çıktılarla "yayınlandı"ya dönüşecek; başka bir duyuru ile değil. Qwen3.8'i üzerine inşa edebileceğiniz açık ağırlıklı bir model olarak değerlendirmeden önce bunların hepsini bekleyin:

  • İndirmeye yönlendiren, yalnızca bir "çok yakında" paylaşımı olmayan resmi bir Alibaba/Qwen duyuru açıklaması.
  • Alibaba’nın Qwen organizasyonu altında, gerçek ağırlık dosyaları içeren bir Hugging Face deposu ve okuduğunuz bir lisans dosyası (açık ağırlıklar ile açık kaynak lisanslar aynı şey değildir).
  • Yalnızca 2.4T toplamı değil, etkin parametreleri, bağlam uzunluğunu ve modaliteleri listeleyen bir model kartı.
  • Alibaba dışındaki birinden, önizleme yerine yayımlanan ağırlıklar üzerinde çalıştırılmış üçüncü taraf benchmark’lar.
  • Barındırılan sürüm için istikrarlı API fiyatlandırması, böylece token başına maliyeti Kimi K3 ve Claude ile karşılaştırabilirsiniz.

Bugün üzerine inşa etmek için bir model seçiyorsanız, kodlama için en iyi açık kaynak LLM'ler derlememiz, ağırlıkları zaten indirilebilir olan seçenekleri kapsar. Qwen3.8'in ağırlıkları ve kararlı bir API kullanıma sunulduğunda, mevcut entegrasyonunuzu yeniden yazmadan onu mevcut modelinizle A/B testine tabi tutabilmeniz için, diğer frontier modellerle birlikte AIReiter gibi Anthropic uyumlu API gateway'leri üzerinden de erişilebilir olacaktır.

SSS

Qwen açık ağırlık mı?

Önceki Qwen modelleri açık ağırlıklarla yayınlandı, ancak her sürüm ayrı bir karardır. Qwen3.8'in ağırlıkları vaat edildi ama henüz yayınlanmadı ve Alibaba'nın en son iki amiral gemisi lansmanda kapalı kaldı; bu yüzden "Qwen açık" ifadesi otomatik olarak 3.8 için geçerli değildir.

Qwen3.8'i kullanmak ücretsiz mi?

Şu anda değil. Qwen3.8-Max-Preview, Alibaba Cloud'un ücretli Token Planı ve Qoder platformlarının arkasında yer alıyor. Ücretsiz Qwen Chat uygulaması hâlâ eski Qwen3.7-Plus'ı kullanıyor.

Qwen3.8, DeepSeek veya Claude'dan daha mı iyi?

Topluluk tarafından bildirilen KingBench 3 puanlarında Qwen3.8-Max, Opus 4.8’i az farkla geride bırakıyor ve Fable 5’in gerisinde yer alıyor. Ancak bunlar doğrulanmamış iddialar ve birkaç testçi, gerçek dünyadaki ajan performansının benchmark sıralamasının altında olduğunu tespit etti. Ağırlıklar henüz yayınlanmadığı için, yayınlanan ağırlıklar üzerinde DeepSeek V4 veya Claude’a karşı bağımsız bir bire bir karşılaştırma da henüz yok.

Qwen3.8 açık-ağırlık sürümünün yayın tarihi nedir?

Alibaba yalnızca "yakında" dedi. Lansman günü sızıntıları, 2026 Temmuz sonu bir kullanıma sunulmaya işaret ediyor ve Reddit’teki ikinci el bir rapor Ağustos’u öneriyor. Alibaba tarafından doğrulanmış kesin bir tarih yok.