Bir milyon tokenlık bağlam penceresi, varsayılan olarak en yüksek akıl yürütme seviyesi ve yalnızca üç hafta arayla gelen iki Çinli mixture-of-experts amiral gemisi... Buna rağmen fiyatları bambaşka. Kimi K3 kodlama tarafında daha güçlü, fakat milyon çıktı tokenı için $15 istiyor; bu, Qwen 3.8 Max'in $6 fiyatının 2.5 katı. Qwen 3.8 Max ise grafikler ve bilgisayar kullanımı görevlerinde öne çıkan, daha yeni ve daha ekonomik seçenek; genel kullanıma 3 Ağustos 2026'da açıldı. Temel fark şu: Her iki model de kutudan çıktığı hâliyle maksimum düzeyde düşünüyor. Bu nedenle Kimi K3'ün yüksek çıktı fiyatı her istekte maliyeti büyütüyor. Qwen'in açık ağırlıkları ise yaklaşık 11 Ağustos'a kadar gelmeyecek.
Aynı sınıfta iki model, farklı öncelikler
Qwen 3.8 Max ve Kimi K3, 2026 ortasında üç hafta arayla yayınlanan; trilyon parametre ölçeğinde, bir milyon token bağlam penceresine ve yerleşik görme yeteneğine sahip iki mixture-of-experts model. Kâğıt üzerinde aynı kategorideler; bu yüzden karşılaştırmalar çoğu zaman benchmark skorlarının ileri geri sıralanmasına indirgeniyor. Oysa asıl karar iki noktada düğümleniyor: Kodlama kalitesindeki avantaj için ne kadar çıktı maliyetini göze alacağınız ve bugün açık ağırlıklara mı, yoksa güçlü çok modlu yeteneklere mi ihtiyaç duyduğunuz.
| Özellik | Qwen 3.8 Max | Kimi K3 |
|---|---|---|
| Toplam parametre | 2.4T | 2.8T |
| Token başına aktif parametre | ~95B | 104B |
| Mimari | MoE (~4% aktif) | MoE (896 uzmandan 16'sı) |
| Bağlam penceresi | ~1M (maksimum 991K girdi) | 1,048,576 |
| Görme | Evet (metin + görsel girdisi) | Evet (yerleşik) |
| Varsayılan akıl yürütme | xhigh, thinking açık | maksimum efor, reasoning açık |
| Açık ağırlıklar | Hayır (~11 Ağustos bekleniyor) | Evet (HF, 27 Temmuz, 1.56TB MXFP4) |
| API durumu | GA, 3 Ağustos 2026 | GA |
Kaynaklar: yottalabs karşılaştırması, AIReiter üzerinden Alibaba QwenCloud ve Moonshot platform.kimi.ai. Doğrulama tarihi: 6 Ağustos 2026.
Fiyatlar, örnek iş yükü maliyeti ve erişim seçenekleri
Her iki şirket de token bazlı fiyatlarını açıkça yayınlıyor; aradaki fark ise parametre sayılarından tahmin edilebilecek yerde değil. Fark, akıl yürüten modellerin bütçesinin büyük bölümünü harcadığı çıktı tokenlarında yoğunlaşıyor. Kimi K3, milyon çıktı tokenı için $15 talep ederken Qwen 3.8 Max $6 istiyor. İki model de varsayılan olarak düşünme sürecini çalıştırdığı için bu ücret yalnızca son yanıtı değil, akıl yürütme izlerini de kapsıyor.
| 1M token başına fiyat | Qwen 3.8 Max | Kimi K3 |
|---|---|---|
| Girdi (cache miss) | $2.00 | $3.00 |
| Girdi (cache hit) | $0.25 | $0.30 |
| Çıktı (thinking dahil) | $6.00 | $15.00 |
| Bağlam | ~1M | 1,048,576 |
Kaynaklar: Alibaba QwenCloud model sayfası (2 Ağustos 2026 güncellemesi) ve Moonshot platform.kimi.ai/docs/pricing/chat-k3. Doğrulama tarihi: 6 Ağustos 2026.
%60 cache-hit oranı, 20M girdi tokenı ve 5M çıktı tokenından oluşan tipik bir kodlama iş yükünde Kimi K3'ün maliyeti yaklaşık $103'e ulaşıyor: $27.60 girdi ve $75 çıktı. Qwen 3.8 Max'te ise toplam yaklaşık $49: $19 girdi ve $30 çıktı. Yaklaşık 2× farkın neredeyse tamamı çıktı maliyetinden kaynaklanıyor. Önbellek, girdi tarafındaki farkı azaltıyor; çıktı fiyatları arasındaki farkı ise azaltan bir mekanizma yok. İki modelin de varsayılan olarak maksimum akıl yürütme kullanması, çıktı kalemini daha da büyütüyor.
Erişim tarafı eşit değil. Qwen 3.8 Max, 3 Ağustos 2026'da Alibaba API'sinde genel kullanıma açıldı; ancak ağırlıkları henüz herkese açık değil. Model sayfasında hâlâ Open Source: No yazıyor ve ağırlıkların 11 Ağustos haftasında Hugging Face ile ModelScope'a gelmesi bekleniyor (Qwen 3.8 Max fiyatlandırma sayfası üzerinden Alibaba). Açık seçenek Kimi K3: Moonshot, 1.56 TB'lık MXFP4 checkpoint'ini 27 Temmuz'da yayınladı ve API aktif durumda.
Kimi K3'e, Moonshot'un resmi fiyatı üzerinden ek ücret olmadan AIReiter'ın Kimi K3 API endpoint'i aracılığıyla da erişilebiliyor. Tek fatura üzerinde K3'ü başka modellerle birlikte denemek isteyenler için kullanışlı bir seçenek. Qwen 3.8 Max henüz buraya entegre edilmiş değil.
Ajan tabanlı kodlamada Kimi K3 neden önde?
İşiniz çok adımlı kodlama süreçleriyse Kimi K3 daha doğru tercih: ajan döngüleri, depo refactor işlemleri, araç çağırmayı ve çıkmazlardan toparlanmayı gerektiren SWE tarzı görevler. Açık ajan tabanlı benchmark'ların tamamında Qwen 3.8 Max'in önünde yer alıyor. Fark da gerçek mühendislik işlerine en çok yaklaşan görevlerde daha belirgin.
| Benchmark | Qwen 3.8 Max | Kimi K3 |
|---|---|---|
| FrontierSWE | 73.5 | 81.2 |
| TerminalBench 2.1 | 86.6 | 88.3 |
| CharXiv (araçlı) | 88.4 | 91.3 |
Kaynak: yottalabs karşılaştırması. Doğrulama tarihi: 6 Ağustos 2026.
Topluluk yorumları da sayıları destekliyor; ancak bu karşılaştırmanın belirleyici noktası olan maliyet uyarısını da ekliyor:
"K3 üst seviye bir model. Qwen 3.8 ona neredeyse benziyor. Ancak abonelik veya API maliyetleri, mevcut hâlleriyle modellerin hiçbiri için haklı gösterilemez..." — r/Qwen_AI
"K3 bu çalışmada Qwen 3.8'i açık ara geride bırakıyor; Qwen, bu açılış sayfasını üretirken Kimi'den 3 kat daha hızlıydı." — @filicroval on X
Kimi K3'ün ham zekâ skoru da daha yüksek: Artificial Analysis Intelligence Index'te 57. Ancak yavaş bir model; saniyede yaklaşık 39 çıktı tokenı üretiyor ve ilk tokena ulaşması 3.1 saniye sürüyor (Artificial Analysis). Karşılığında daha yüksek kalite ve açıklık sunuyor; bedeli ise gecikme ve maliyet.
Çok modlu görevlerde ve maliyette Qwen 3.8 Max avantajı
İş yükünüz grafik, ekran görüntüsü veya belge okumaya; tarayıcı ya da bilgisayar kullanımı görevlerine dayanıyorsa ve kodlama benchmark'ındaki son birkaç puandan çok çıktı maliyeti önemliyse Qwen 3.8 Max daha mantıklı seçim. Belge ve algı benchmark'larında Kimi K3'ü geçiyor, bilgisayar kullanımı alanındaki bir benchmark'ta doğrulanmış state-of-the-art sonucu elinde tutuyor. Üstelik Kimi K3'ün çıktı ücretinin yalnızca %40'ını alıyor.
| Benchmark | Qwen 3.8 Max | Kimi K3 |
|---|---|---|
| CharXiv (araçsız) | 93.5 | 84.8 |
| PerceptionBench | 63.5 | 58.5 |
| OSWorld-Verified | 86.1% (SOTA) | herkese açık skor yok |
Kaynak: yottalabs karşılaştırması. Doğrulama tarihi: 6 Ağustos 2026.
Qwen 3.8 Max'in zayıf noktası, Kimi K3'ün en güçlü olduğu alanla aynı: En uç kapalı modellerle rekabet eden zor yazılım mühendisliği görevleri. SWE-bench Pro'da 67.7 alıyor; Claude Fable 5'in 80 skorunun oldukça gerisinde (Alibaba'nın yayınladığı, üretici tarafından yürütülen tablo). Bu nedenle en zorlu yazılım mühendisliği değerlendirmeleri için doğru model değil. Ayrıca API'si yazının hazırlandığı sırada yalnızca üç gündür kullanımdaki bir servis; genel kullanıma 3 Ağustos 2026'da açıldı. Ağırlıkları da hâlâ kapalı olduğundan (erişim ayrıntıları yukarıda), bugün kendi altyapısında çalıştırmak isteyenlerin beklemesi veya Kimi K3'ü seçmesi gerekiyor.
İş yükünüze göre doğru modeli seçin
Doğru seçim, hangi modelin mutlak anlamda daha iyi olduğundan çok onu hangi görev için çağıracağınıza bağlı. Aşağıdaki tablo, yaygın iş yüklerini uygun model ve doğrulanmış gerekçesiyle eşleştiriyor.
| İş yükünüz... | Tercih | Neden? |
|---|---|---|
| Ajan döngüleri, depo refactor işlemleri, SWE görevleri ise (maliyet öncelik değilse) | Kimi K3 | FrontierSWE 81.2'ye 73.5, TerminalBench 88.3'e 86.6 |
| Belge/grafik ayrıştırma, tarayıcı veya bilgisayar kullanımı içeriyorsa ve maliyet hassassa | Qwen 3.8 Max | CharXiv 93.5, OSWorld 86.1% SOTA, $6'ya karşı $15 çıktı |
| Bugün kendi altyapınızda çalıştırmak istiyorsanız | Kimi K3 | Ağırlıklar 27 Temmuz'dan beri HF'de; Qwen'inkiler ~11 Ağustos'ta geliyor |
Sık sorulan sorular
Kodlama için Qwen 3.8 Max, Kimi K3'ten daha mı iyi?
Hayır. Kimi K3, önemli ajan tabanlı kodlama benchmark'larında önde: FrontierSWE'de 81.2'ye 73.5, TerminalBench 2.1'de 88.3'e 86.6. Dolayısıyla çok adımlı mühendislik görevlerinde daha güçlü tercih Kimi K3.
Qwen 3.8 Max mi, Kimi K3 mü daha ucuz?
Qwen 3.8 Max. Milyon çıktı tokenı başına $6 alırken Kimi K3 $15 istiyor; girdi fiyatı da $2'ye karşı $3. Cache-hit fiyatları birbirine yakın ve tipik bir kodlama iş yükünde maliyet farkı yaklaşık 2× seviyesinde.
Maksimum akıl yürütmeyle ajan tabanlı kodlama için hangisi daha ucuz?
Yine Qwen 3.8 Max. Her iki model de maksimum efordaki akıl yürütme tokenlarını çıktı olarak ücretlendiriyor. Bu nedenle Kimi K3'ün $15/M fiyatı, tam da üstün olduğu kodlama iş yükünde maliyet farkını açıyor.
İki model de bir milyon tokenlık bağlam desteği sunuyor mu?
Evet. Qwen 3.8 Max yaklaşık 991K girdi tokenı kabul ediyor; thinking açıkken bu sayı daha düşük. Kimi K3 ise 1,048,576 token alıyor. Her ikisi de nominal olarak bir milyon tokenlık pencereye sahip.
Ağırlıklar açık mı?
Kimi K3'ün ağırlıkları açık. Moonshot, 1.56 TB'lık MXFP4 checkpoint'ini 27 Temmuz 2026'da yayınladı. Qwen 3.8 Max'in ağırlıkları henüz açık değil; Alibaba modeli kapalı olarak listeliyor ve Hugging Face ile ModelScope yayınının 11 Ağustos haftasında yapılması bekleniyor.
İlgili içerikler
- Kimi K3 model sayfası: Kimi K3 için tek model odaklı inceleme
- Qwen 3.8 Max API fiyatlandırması: Qwen 3.8 Max için kapsamlı fiyat ve teknik özellik analizi
- Qwen3.8-27B: kendi altyapısında çalıştırma için daha küçük, açık ağırlıklı Qwen 3.8 sürümü
- Kimi K2.7 Code vs GLM 5.2: aynı kodlama modeli kümesinden yakın bir karşılaştırma