AIREITER

Qwen 3.8 Max ve Kimi K3: Daha Ucuz Çıktı, Daha İyi Kodlama (2026)

Son Güncelleme: 2026-08-06 07:44:00

Bir milyon tokenlık bağlam penceresi, varsayılan olarak en yüksek akıl yürütme seviyesi ve yalnızca üç hafta arayla gelen iki Çinli mixture-of-experts amiral gemisi... Buna rağmen fiyatları bambaşka. Kimi K3 kodlama tarafında daha güçlü, fakat milyon çıktı tokenı için $15 istiyor; bu, Qwen 3.8 Max'in $6 fiyatının 2.5 katı. Qwen 3.8 Max ise grafikler ve bilgisayar kullanımı görevlerinde öne çıkan, daha yeni ve daha ekonomik seçenek; genel kullanıma 3 Ağustos 2026'da açıldı. Temel fark şu: Her iki model de kutudan çıktığı hâliyle maksimum düzeyde düşünüyor. Bu nedenle Kimi K3'ün yüksek çıktı fiyatı her istekte maliyeti büyütüyor. Qwen'in açık ağırlıkları ise yaklaşık 11 Ağustos'a kadar gelmeyecek.

Aynı sınıfta iki model, farklı öncelikler

Qwen 3.8 Max ve Kimi K3, 2026 ortasında üç hafta arayla yayınlanan; trilyon parametre ölçeğinde, bir milyon token bağlam penceresine ve yerleşik görme yeteneğine sahip iki mixture-of-experts model. Kâğıt üzerinde aynı kategorideler; bu yüzden karşılaştırmalar çoğu zaman benchmark skorlarının ileri geri sıralanmasına indirgeniyor. Oysa asıl karar iki noktada düğümleniyor: Kodlama kalitesindeki avantaj için ne kadar çıktı maliyetini göze alacağınız ve bugün açık ağırlıklara mı, yoksa güçlü çok modlu yeteneklere mi ihtiyaç duyduğunuz.

ÖzellikQwen 3.8 MaxKimi K3
Toplam parametre2.4T2.8T
Token başına aktif parametre~95B104B
MimariMoE (~4% aktif)MoE (896 uzmandan 16'sı)
Bağlam penceresi~1M (maksimum 991K girdi)1,048,576
GörmeEvet (metin + görsel girdisi)Evet (yerleşik)
Varsayılan akıl yürütmexhigh, thinking açıkmaksimum efor, reasoning açık
Açık ağırlıklarHayır (~11 Ağustos bekleniyor)Evet (HF, 27 Temmuz, 1.56TB MXFP4)
API durumuGA, 3 Ağustos 2026GA

Kaynaklar: yottalabs karşılaştırması, AIReiter üzerinden Alibaba QwenCloud ve Moonshot platform.kimi.ai. Doğrulama tarihi: 6 Ağustos 2026.

Fiyatlar, örnek iş yükü maliyeti ve erişim seçenekleri

Her iki şirket de token bazlı fiyatlarını açıkça yayınlıyor; aradaki fark ise parametre sayılarından tahmin edilebilecek yerde değil. Fark, akıl yürüten modellerin bütçesinin büyük bölümünü harcadığı çıktı tokenlarında yoğunlaşıyor. Kimi K3, milyon çıktı tokenı için $15 talep ederken Qwen 3.8 Max $6 istiyor. İki model de varsayılan olarak düşünme sürecini çalıştırdığı için bu ücret yalnızca son yanıtı değil, akıl yürütme izlerini de kapsıyor.

1M token başına fiyatQwen 3.8 MaxKimi K3
Girdi (cache miss)$2.00$3.00
Girdi (cache hit)$0.25$0.30
Çıktı (thinking dahil)$6.00$15.00
Bağlam~1M1,048,576

Kaynaklar: Alibaba QwenCloud model sayfası (2 Ağustos 2026 güncellemesi) ve Moonshot platform.kimi.ai/docs/pricing/chat-k3. Doğrulama tarihi: 6 Ağustos 2026.

Moonshot platformundaki resmi Kimi K3 API fiyatlandırması: milyon cache-miss girdisi başına $3.00, cache okuması $0.30, çıktı $15.00, 1,048,576 token bağlam

%60 cache-hit oranı, 20M girdi tokenı ve 5M çıktı tokenından oluşan tipik bir kodlama iş yükünde Kimi K3'ün maliyeti yaklaşık $103'e ulaşıyor: $27.60 girdi ve $75 çıktı. Qwen 3.8 Max'te ise toplam yaklaşık $49: $19 girdi ve $30 çıktı. Yaklaşık 2× farkın neredeyse tamamı çıktı maliyetinden kaynaklanıyor. Önbellek, girdi tarafındaki farkı azaltıyor; çıktı fiyatları arasındaki farkı ise azaltan bir mekanizma yok. İki modelin de varsayılan olarak maksimum akıl yürütme kullanması, çıktı kalemini daha da büyütüyor.

Erişim tarafı eşit değil. Qwen 3.8 Max, 3 Ağustos 2026'da Alibaba API'sinde genel kullanıma açıldı; ancak ağırlıkları henüz herkese açık değil. Model sayfasında hâlâ Open Source: No yazıyor ve ağırlıkların 11 Ağustos haftasında Hugging Face ile ModelScope'a gelmesi bekleniyor (Qwen 3.8 Max fiyatlandırma sayfası üzerinden Alibaba). Açık seçenek Kimi K3: Moonshot, 1.56 TB'lık MXFP4 checkpoint'ini 27 Temmuz'da yayınladı ve API aktif durumda.

Kimi K3'e, Moonshot'un resmi fiyatı üzerinden ek ücret olmadan AIReiter'ın Kimi K3 API endpoint'i aracılığıyla da erişilebiliyor. Tek fatura üzerinde K3'ü başka modellerle birlikte denemek isteyenler için kullanışlı bir seçenek. Qwen 3.8 Max henüz buraya entegre edilmiş değil.

Ajan tabanlı kodlamada Kimi K3 neden önde?

İşiniz çok adımlı kodlama süreçleriyse Kimi K3 daha doğru tercih: ajan döngüleri, depo refactor işlemleri, araç çağırmayı ve çıkmazlardan toparlanmayı gerektiren SWE tarzı görevler. Açık ajan tabanlı benchmark'ların tamamında Qwen 3.8 Max'in önünde yer alıyor. Fark da gerçek mühendislik işlerine en çok yaklaşan görevlerde daha belirgin.

Karşılıklı benchmark sonuçları: Kimi K3 TerminalBench 2.1, FrontierSWE ve araçlı CharXiv'de önde; Qwen 3.8 Max araçsız CharXiv ve PerceptionBench'te önde
BenchmarkQwen 3.8 MaxKimi K3
FrontierSWE73.581.2
TerminalBench 2.186.688.3
CharXiv (araçlı)88.491.3

Kaynak: yottalabs karşılaştırması. Doğrulama tarihi: 6 Ağustos 2026.

Topluluk yorumları da sayıları destekliyor; ancak bu karşılaştırmanın belirleyici noktası olan maliyet uyarısını da ekliyor:

"K3 üst seviye bir model. Qwen 3.8 ona neredeyse benziyor. Ancak abonelik veya API maliyetleri, mevcut hâlleriyle modellerin hiçbiri için haklı gösterilemez..." — r/Qwen_AI

"K3 bu çalışmada Qwen 3.8'i açık ara geride bırakıyor; Qwen, bu açılış sayfasını üretirken Kimi'den 3 kat daha hızlıydı." — @filicroval on X

Kimi K3'ün ham zekâ skoru da daha yüksek: Artificial Analysis Intelligence Index'te 57. Ancak yavaş bir model; saniyede yaklaşık 39 çıktı tokenı üretiyor ve ilk tokena ulaşması 3.1 saniye sürüyor (Artificial Analysis). Karşılığında daha yüksek kalite ve açıklık sunuyor; bedeli ise gecikme ve maliyet.

Çok modlu görevlerde ve maliyette Qwen 3.8 Max avantajı

İş yükünüz grafik, ekran görüntüsü veya belge okumaya; tarayıcı ya da bilgisayar kullanımı görevlerine dayanıyorsa ve kodlama benchmark'ındaki son birkaç puandan çok çıktı maliyeti önemliyse Qwen 3.8 Max daha mantıklı seçim. Belge ve algı benchmark'larında Kimi K3'ü geçiyor, bilgisayar kullanımı alanındaki bir benchmark'ta doğrulanmış state-of-the-art sonucu elinde tutuyor. Üstelik Kimi K3'ün çıktı ücretinin yalnızca %40'ını alıyor.

BenchmarkQwen 3.8 MaxKimi K3
CharXiv (araçsız)93.584.8
PerceptionBench63.558.5
OSWorld-Verified86.1% (SOTA)herkese açık skor yok

Kaynak: yottalabs karşılaştırması. Doğrulama tarihi: 6 Ağustos 2026.

Qwen 3.8 Max'in zayıf noktası, Kimi K3'ün en güçlü olduğu alanla aynı: En uç kapalı modellerle rekabet eden zor yazılım mühendisliği görevleri. SWE-bench Pro'da 67.7 alıyor; Claude Fable 5'in 80 skorunun oldukça gerisinde (Alibaba'nın yayınladığı, üretici tarafından yürütülen tablo). Bu nedenle en zorlu yazılım mühendisliği değerlendirmeleri için doğru model değil. Ayrıca API'si yazının hazırlandığı sırada yalnızca üç gündür kullanımdaki bir servis; genel kullanıma 3 Ağustos 2026'da açıldı. Ağırlıkları da hâlâ kapalı olduğundan (erişim ayrıntıları yukarıda), bugün kendi altyapısında çalıştırmak isteyenlerin beklemesi veya Kimi K3'ü seçmesi gerekiyor.

İş yükünüze göre doğru modeli seçin

Doğru seçim, hangi modelin mutlak anlamda daha iyi olduğundan çok onu hangi görev için çağıracağınıza bağlı. Aşağıdaki tablo, yaygın iş yüklerini uygun model ve doğrulanmış gerekçesiyle eşleştiriyor.

İş yükünüz...TercihNeden?
Ajan döngüleri, depo refactor işlemleri, SWE görevleri ise (maliyet öncelik değilse)Kimi K3FrontierSWE 81.2'ye 73.5, TerminalBench 88.3'e 86.6
Belge/grafik ayrıştırma, tarayıcı veya bilgisayar kullanımı içeriyorsa ve maliyet hassassaQwen 3.8 MaxCharXiv 93.5, OSWorld 86.1% SOTA, $6'ya karşı $15 çıktı
Bugün kendi altyapınızda çalıştırmak istiyorsanızKimi K3Ağırlıklar 27 Temmuz'dan beri HF'de; Qwen'inkiler ~11 Ağustos'ta geliyor

Sık sorulan sorular

Kodlama için Qwen 3.8 Max, Kimi K3'ten daha mı iyi?

Hayır. Kimi K3, önemli ajan tabanlı kodlama benchmark'larında önde: FrontierSWE'de 81.2'ye 73.5, TerminalBench 2.1'de 88.3'e 86.6. Dolayısıyla çok adımlı mühendislik görevlerinde daha güçlü tercih Kimi K3.

Qwen 3.8 Max mi, Kimi K3 mü daha ucuz?

Qwen 3.8 Max. Milyon çıktı tokenı başına $6 alırken Kimi K3 $15 istiyor; girdi fiyatı da $2'ye karşı $3. Cache-hit fiyatları birbirine yakın ve tipik bir kodlama iş yükünde maliyet farkı yaklaşık 2× seviyesinde.

Maksimum akıl yürütmeyle ajan tabanlı kodlama için hangisi daha ucuz?

Yine Qwen 3.8 Max. Her iki model de maksimum efordaki akıl yürütme tokenlarını çıktı olarak ücretlendiriyor. Bu nedenle Kimi K3'ün $15/M fiyatı, tam da üstün olduğu kodlama iş yükünde maliyet farkını açıyor.

İki model de bir milyon tokenlık bağlam desteği sunuyor mu?

Evet. Qwen 3.8 Max yaklaşık 991K girdi tokenı kabul ediyor; thinking açıkken bu sayı daha düşük. Kimi K3 ise 1,048,576 token alıyor. Her ikisi de nominal olarak bir milyon tokenlık pencereye sahip.

Ağırlıklar açık mı?

Kimi K3'ün ağırlıkları açık. Moonshot, 1.56 TB'lık MXFP4 checkpoint'ini 27 Temmuz 2026'da yayınladı. Qwen 3.8 Max'in ağırlıkları henüz açık değil; Alibaba modeli kapalı olarak listeliyor ve Hugging Face ile ModelScope yayınının 11 Ağustos haftasında yapılması bekleniyor.

İlgili içerikler