DeepSeek Kurumsal AI Maliyet Dinamikleri: %75 İndirimi Kim Aldı?

Son Güncelleme: 2026-07-15 02:19:18

DeepSeek'in V4 Pro modeli artık resmi API üzerinde milyon girdi token başına $0.435 ve milyon çıktı token başına $0.87 ücretlendiriliyor. Aynı model Azure AI Foundry'de hâlâ $1.74 ve $3.48 olarak listeleniyor; bu da tam olarak indirim öncesi fiyat. 14 Temmuz 2026'da doğrulanan bu 4 katlık fark, şu anda DeepSeek kurumsal AI maliyet dinamikleri hakkında tek en önemli gerçektir: şirketinizin ödediği ücret, modelden çok ona ulaşmak için hangi kapıdan içeri girdiğinize bağlıdır.

Bu makale, doğrudan API ve Azure için tarih damgalı sayılar verir, bir yeniden satıcı yolunu test eder, aynı iş yükünü her iki V4 modeli üzerinden çalıştırır ve bir karar çerçevesiyle birlikte tek bir son tarihle biter: eski deepseek-chat ve deepseek-reasoner takma adları 24 Temmuz 2026'da kullanımdan kaldırılacak.

DeepSeek V4 fiyatlandırması bugün: önemli olan rakamlar

İşte DeepSeek'in API dokümantasyonundan alınan resmi fiyat listesi, 14 Temmuz 2026 tarihinde kontrol edilmiştir:

ModelGirdi (önbellek isabeti)Girdi (önbellek kaçırma)ÇıktıBağlamEşzamanlılık sınırı
deepseek-v4-flash$0.0028/M$0.14/M$0.28/M1M tokens2,500
deepseek-v4-pro$0.003625/M$0.435/M$0.87/M1M tokens500
DeepSeek official API pricing table showing V4 Flash and V4 Pro rates per million tokens

O tabloda yer alan üç ayrıntı, başlık oranlarından daha önemlidir:

  • Önbellek-hiti fiyatı, aracı iş yükleri için gerçek fiyattır. V4 Pro’da bir önbellek hiti, milyon token başına $0.003625 tutar; bu, bir önbellek kaçırmadan 120 kat daha ucuzdur. Her çağrıda aynı sistem istemini ve araç tanımlarını yeniden gönderen aracı sistemler neredeyse tamamen önbellek bölgesinde yaşar ve DeepSeek, yapılandırma gerektirmeden önbelleğe almayı otomatik olarak uygular.
  • Promosyon yıldızı yoktur. Lansman promosyonu olarak başlayan %75 indirimi artık liste fiyatıdır. Fiyatlandırma sayfasında herhangi bir son kullanım tarihi yer almıyor. InfoWorld'ün haberi, bu kalıcılığı V4 Pro'nun mühendisliğine bağladı: uzun bağlamda, selefinin token başına hesaplama maliyetinin yaklaşık dörtte biri; dolayısıyla indirim yapısaldır, sübvansiyon değil.
  • Alias son tarihi gerçektir. deepseek-chat ve deepseek-reasoner model adları 24 Temmuz 2026, 15:59 UTC'de kullanımdan kaldırılacaktır. Hâlâ bu adları çağıran üretim kodunun deepseek-v4-flash veya deepseek-v4-pro için tek satırlık bir geçiş yapması gerekir. Yeni varsayılanlar düşünme modunda çalıştığı için, modu açıkça ayarlamazsanız çıktı token sayıları (ve faturalar) değişecektir.

Her iki model de 1M-token bağlam penceresi ve 384K’ya kadar çıktı token’ı sunar; API artık OpenAI formatının yanı sıra api.deepseek.com/anthropic adresinde Anthropic ile uyumlu bir format da sunuyor; bu, ekibiniz DeepSeek’i Claude için oluşturulmuş araçlara entegre etmek istiyorsa önemlidir.

%75'lik kesinti her kanala ulaşmadı

Azure AI Foundry, aynı DeepSeek-V4 Pro’yu milyon token başına girişte $1.74 ve çıkışta $3.48 fiyatla satar (Global deployment, Central US, 14 Temmuz 2026 tarihinde doğrulanmıştır). Bu, kesinti öncesi fiyat olup değişmemiştir. Azure’daki V4 Flash $0.19/$0.51 olarak çalışır: doğrudan API'nin cache-miss oranına kıyasla girişte %36 ve çıkışta %82 primlidir.

Azure AI Foundry pricing table listing DeepSeek V4 Pro Global at $1.74 input and $3.48 output per million tokens

Kontrol ettiğimiz Azure fiyatlandırma sayfasında (Global deployment, Central US, 14 Temmuz 2026), herhangi bir DeepSeek modeli için cached-input satır kalemi görünmüyor; Microsoft hesap ekibinizle doğrulayın, çünkü marketplace fiyatlandırması sağlayıcı fiyatlandırmasının gerisinde kalabilir. Direct API’de, prefix yeniden kullanımının yoğun olduğu bir agent iş yükü, milyon input token başına sentin çok küçük kesirlerini öder; Azure’da ise bu token’ların her biri tam tarifeden ücretlendirilir. Cache ağırlıklı iş yüklerinde fiili fark 4x değildir; input tarafında 100x’i aşabilir.

Azure’a hakkını vermek gerekirse, aynı şeyi satın almıyorsunuz. Foundry hosting, trafiği Microsoft’un bulutunun içinde, Microsoft’un veri işleme koşulları kapsamında, Azure SLA’larıyla tutar ve verilerin Çinli bir şirket tarafından işletilen sunuculara çıkmaması, birçok uyumluluk ekibi için asıl mesele budur. Microsoft, DeepSeek’i Copilot’un çoklu model yönlendirmesine entegre ederken tam olarak bu şekilde konumlanıyor. Ancak bu yönetişim primi artık ölçülebilir durumda: aşağıdaki referans iş yükü için, iş yükü başına ayda 31 dolar ile 209 dolar arasındaki farktır ve satın alma ekipleri bunu görünmez bir varsayılan olarak yutmak yerine, bir kalem olarak fiyatlandırmalıdır.

Toplayıcılar ve API yeniden satıcıları arada yer alır. OpenRouter gibi platformlar, fiyatlandırmayı resmi orana yakın şekilde aktarır ve topluluk raporları, DeepSeek'in global cache'inin onlar üzerinden de geçerli olmaya devam ettiğini belirtir. İşin püf noktası görünürlüktür; bunu aşağıda daha ayrıntılı ele alacağız, çünkü test ettik.

Gerçek bir kurumsal iş yükünün maliyeti nedir

Kağıt üzerindeki oranlar, onları bir iş yüküyle çarptığınızda karara dönüşür. Orta ölçekli bir kurumsal asistanı ele alalım: ayda 100M input tokenı (sistem promptlarını sürekli yeniden gönderen agent trafiği için muhafazakâr bir oran olan %50 cache hit) artı 10M output token. İşte 14 Temmuz 2026'da doğrulanmış oranlar kullanılarak, aynı iş yükünün altı kanal genelinde fiyatlandırması:

Bar chart comparing monthly cost of the same workload across six channels, from $9.94 on DeepSeek V4 Flash direct to $575 on GPT-5.6-Sol
KanalAylık maliyet
DeepSeek V4 Flash, doğrudan API$9.94
Azure V4 Flash Global$24.10
DeepSeek V4 Pro, doğrudan API$30.63
GPT-5.6-Luna (OpenAI)$115.00
Azure V4 Pro Global$208.80
GPT-5.6-Sol (OpenAI)$575.00

Tablonun arkasındaki matematik yeniden kullanılabilir: aylık maliyet = miss_tokens x miss_rate + hit_tokens x hit_rate + output_tokens x output_rate. Cache payı bunu domine eder. V4 Pro üzerinde aynı 100M-input iş yükü, %0 cache hit’te ayda doğrudan $52.20, %50’de $30.63 ve %90’da $13.38 tutar - Azure’da ise yayınlanmış bir cache indirimi olmadığı için üç durumda da $208.80 olarak kalır.

Bu tablonun iki yorumu var. Birincisi, en ucuz DeepSeek kanalı ile en pahalı frontier kanalı, aynı trafik üzerinde 58 kat farklılık gösteriyor. İkincisi, ve daha az bariz olanı: Azure'un DeepSeek V4 Pro'su, OpenAI'nin GPT-5.6-Luna'sından daha pahalıya geliyor. Tedarik özetinizde "para tasarrufu için DeepSeek üzerinde standartlaştık" yazıyor ama dağıtım Azure Global ise, elde edilen tasarruf orta seviye bir OpenAI modelinin sağlayacağından daha küçük olabilir.

Bütçeleri aşan çarpan, ajansal büyütmedir. Tek dönüşlü bir chatbot, kullanıcı başına kabaca bir çağrı faturalandırır; üretim ortamındaki bir agent ise planlama, geri getirme, araç çağrıları ve doğrulamayı zincirler ve girişten faturalandırılan çıktıya oran 1:700’e kadar çıkabilir; VentureBeat’in Temmuz 2026 tarihli agent ekonomisi analizinin “100x sorunu” dediği şey budur. Bu oranda, bizim 100M-token referans iş yükümüz, tüm bir şirketin trafiği değil, orta derecede yoğun tek bir agent özelliğinin üreteceği miktardır. Token başına ucuz fiyatlandırma, maliyet kontrollerini atlamak için bir izin değildir; agent ürünlerini geliştirirken onları ayakta tutan şey budur.

Aynı işi V4 Flash ve V4 Pro üzerinde çalıştırdık

Fiyatlandırma sayfaları, mühendislerinizin soracağı soruyu yanıtlamaz: tek bir isteğin maliyeti nedir ve ne kadar sürer? 14 Temmuz 2026'da, aynı kodlama görevini - "Bir ISO 8601 süre dizesini toplam saniyeye ayrıştıran, 3 test vakası içeren bir Python fonksiyonu yazın" - varsayılan ayarlarda (düşünme modu açık, maksimum 4.000 çıktı tokenı) bir OpenAI uyumlu yeniden satıcı uç noktası üzerinden her iki V4 modeline de gönderdik. Yeniden satıcının adını vermiyoruz çünkü önemli olan tek bir satıcı değil, bu kategorinin davranışıdır; ham yanıtlar DeepSeek'in reasoning_content alanını içeriyordu ve bu da temel modeli böyle doğruladığımız yoldur:

V4 FlashV4 Pro
Gerçek zamanlı süre15.5s35.1s
Tamamlanma tokenları (akıl yürütme dahil)1,6901,902
Etkin çıktı hızı~109 tok/s~54 tok/s
Resmi tarifelerle maliyet~$0.0005~$0.0017

Uyarılar açıkça belirtilirse: bu tek bir örnektir ve gecikme relay ek yükünü içerir, bu nedenle duvar saati sürelerini doğrudan API’nin bir kıyaslaması yerine bir üst sınır olarak değerlendirin. Her iki yanıt da DeepSeek’in imza niteliğindeki reasoning_content alanını döndürdü: her iki model de varsayılan olarak thinking mode’da çalışır ve bu reasoning token’ları çıktı olarak ücretlendirilir. Flash, yanıt vermeden önce bir parsing fonksiyonu hakkında düşünmek için 2.703 karakter harcadı. İş yükünüz chain-of-thought gerektirmiyorsa, thinking’i kapatmak mevcut en ucuz optimizasyonlardan biridir. Pro’nun ekstra kalitesinin 3 kat fiyatı ne zaman haklı çıkardığına dair daha derin bir birebir karşılaştırma için, her iki modeli de DeepSeek V4 Flash vs V4 Pro içinde tam bir karşılaştırmadan geçirdik.

Test, daha önce başka bir yerde belgelenmiş görmediğimiz bir bulguyu ortaya çıkardı: relay channel’ın kullanım raporlarında cache dökümü yoktu. Aynı 824 token’lık öneki art arda iki kez gönderdik - reseller DeepSeek’in prefix caching’ini koruyorsa bunun ders kitabı niteliğinde bir cache hit olması gerekir - ve API yanıtı yalnızca prompt_tokens, completion_tokens ve total_tokens değerlerini raporladı; prompt_cache_hit_tokens ayrımı yoktu. Doğrudan API’de bu alan, 120x cache indiriminin faturanıza yansıyıp yansımadığını denetlemenin yoludur. Bir aracı üzerinden, indirimi doğrulayamadan alabilirsiniz ya da hiç alamayabilirsiniz. DeepSeek’i herhangi bir reseller üzerinden satın alıyorsanız, özellikle cache-hit fiyatlandırmasının aktarılıp aktarılmadığını ve faturanızda nasıl göründüğünü sorun.

Doğrudan API, Azure veya bir toplayıcı: nasıl seçilir

Kanal kararı kısa bir tabloya indirgenir:

Doğrudan APIAzure AI FoundryToplayıcı/yeniden satıcı
V4 Pro fiyatı (giriş/çıkış her M için)$0.435 / $0.87$1.74 / $3.48Değişir; genellikle resmî olana yakındır
Önbellek isabet indirimiEvet, otomatik, denetlenebilirListelenmiyorBazen; çoğu zaman denetlenebilir değil
Veri yerleşimiDeepSeek'in sunucularıMicrosoft bulutu, kendi tenantınızYeniden satıcının altyapısı
Sözleşme/uyumlulukÇinli tüzel kişilikMevcut Azure anlaşmasıYeniden satıcının şartları
Eşzamanlılık500 (Pro) / 2,500 (Flash)PTU tahsisi mevcutHavuzlanmış, değişir
Çoklu model konsolidasyonuYalnızca DeepSeekFoundry kataloğuGeniş katalog, tek fatura

Pratikte: doğrudan API, saf ekonomi açısından kazanır: hiçbir kanal, milyon başına $0.003625 fiyatındaki cache-hit fiyatlandırmasıyla yarışamaz ve bu indirimi denetleyebileceğiniz tek kanal budur. Azure, hukuk ekibiniz DeepSeek’in kendi altyapısına giden trafiği onaylamadığında kazanır; yönetişim için efektif oranın yaklaşık 7 katını ödüyor olursunuz ve bunu bilinçli olarak yaptığınız sürece bu tercih tamamen rasyonel olabilir. Toplayıcılar, DeepSeek’in bir router arkasındaki birkaç modelden biri olduğu ve tek fatura altında toplamanın ince bir marja değdiği durumlarda kazanır; hacim taahhüt etmeden önce cache geçişini doğrulayın.

Hangi kanalı seçerseniz seçin, DeepSeek faturalarını sabit tutan yönlendirme kuralları gösterişsizdir: varsayılan sınıflandırmayı, çıkarımı ve özetlemeyi Flash’a yönlendirin; Pro’yu çok dosyalı kod üretimi ve uzun bağlamlı akıl yürütme için ayırın; deterministik görevler için thinking mode’u kapatın (bu reasoning token’lar output olarak faturalandırılır); ve her workflow için agent loop derinliğini sınırlandırın. İyi ayarlanmış bir router, Flash ile Pro arasındaki 3x farktan daha önemlidir.

DeepSeek neden bu kadar düşük fiyat sunabiliyor — ve bunun sürdürülebilir olup olmadığı

Fiyatlar bir zararına satış gösterisi değil. V4’ün mimarisi, toplamda 1,6 trilyon parametreye sahip ancak her ileri geçişte yalnızca yaklaşık 49 milyar aktif parametre kullanan bir uzmanlar-karışımı tasarımıdır: DeepSeek’in yayımlanan sonuçlarına göre frontier düzeyinde yetenek (SWE-bench Verified üzerinde %80,6) elde ederken orta ölçekli bir model kadar hesaplama ile çıkarım yaparsınız. V4 Pro revizyonu özellikle uzun bağlam maliyetine saldırdı; bu yüzden şirket, %75’lik promosyonu süresi dolduğunda bırakmak yerine kalıcı fiyat haline getirdi.

İş gidişatı alıcıları destekliyor. Sektördeki çoğu tahmine göre, frontier inference birim maliyetleri yılda kabaca 3 kat düşüyor ve DeepSeek'in bir yıl içindeki indirimi, context length 1M tokens'a çıkmış olsa da, bu eğriyi bile geride bırakıyor. OpenAI ise aynı dönemde ters yönde ilerleyerek amiral gemisi katmanını GPT-5.6-Sol ile $5/$30 seviyesine taşıdı.

Karşı ağırlık Jevons’tur: daha ucuz inference daha fazla inference üretir. New Street Research’ün gözlemi - V3 döneminden beri alıntılanıyor - artan rekabetin toplam harcamayı nadiren azalttığı, AI inşası boyunca doğrulanmıştır. Agent benimsenmesi, kullanıcı başına çağrı sayısını token başına fiyatlar düşerken daha hızlı katlar; bütçelerini sabit tutan işletmelerin, en ucuz modeli seçenler değil, yönlendirme, önbellekleme ve prompt disiplinini birinci sınıf mühendislik olarak ele alanlar olmasının nedeni budur. Yalnızca etiket fiyatını değil, bu maliyet dinamiklerini anlamak, ucuz kalmayı sürdüren bir DeepSeek dağıtımını sessizce şişen bir dağıtımdan ayıran şeydir.

SSS

DeepSeek V4 nasıl bu kadar ucuz?

Uzman karışımı mimarisi: toplam 1.6T parametre, token başına yaklaşık 49B aktif. Token başına hesaplama maliyeti, çok daha küçük bir modele benzer ve V4 Pro’nun uzun bağlam mühendisliği, token başına hesaplamayı selefinin yaklaşık dörtte birine indirdi. Fiyatlandırma yapısaldır, promosyonel değildir.

DeepSeek V4 Pro fiyatı ne kadar düşürüldü?

%75: milyon token başına $1.74/$3.48'den (girdi/çıktı) $0.435/$0.87'ye. Bu, sınırlı bir promosyon olarak başladı ve kalıcı liste fiyatı haline geldi.

75% fiyat indirimi Azure için geçerli mi?

Hayır. 14 Temmuz 2026 itibarıyla, Azure AI Foundry, DeepSeek-V4 Pro Global'ı $1.74/$3.48 olarak, indirim öncesi oranla ve yayımlanmış bir önbelleğe alınmış giriş fiyatlandırması olmadan listeliyor. Önbellek yoğun iş yüklerinde, doğrudan API'ye kıyasla etkin fark 4x'i aşabilir; pazar yeri fiyatlandırması tedarikçi indirimlerinin gerisinde kalabildiğinden, güncel oranlar için Microsoft ile kontrol edin.

DeepSeek işletme kullanımı için ücretsiz mi?

API, token başına ücretlendirilir, ancak model ağırlıkları MIT lisanslıdır, bu nedenle self-hosting ticari kullanım için yasaldır. V4 ölçeğinde ciddi GPU altyapısına ihtiyaç duyarsınız; çoğu ekip için API’nin token başına fiyatı, self-hosted TCO’yu büyük bir farkla geride bırakır.

DeepSeek'in maliyeti ChatGPT ile nasıl karşılaştırılır?

API fiyatlandırmasında, DeepSeek V4 Pro ($0.435/$0.87), girişte GPT-5.6-Sol'a ($5/$30) göre yaklaşık 11 kat, çıktıda ise 34 kat daha ucuzdur. ChatGPT abonelikleri ($20–$200/ay koltuk başına) farklı bir üründür; programatik iş yükleri için anlamlı olan karşılaştırma, API'den API'ye yapılan karşılaştırmadır.

24 Temmuz'dan önce ne yapmalı

Öncelik sırasına göre üç eylem:

1. Model takma adlarını şimdi taşıyın. deepseek-chat ve deepseek-reasoner 24 Temmuz 2026, 15:59 UTC'de çözülmeyi durduracak. deepseek-v4-flash veya deepseek-v4-pro modelini açıkça sabitleyin ve düşünme modunu bilinçli olarak ayarlayın; varsayılan değişti ve akıl yürütme token'ları çıktı olarak faturalandırılır. 2. Kanalınızın fiyatlandırmasını yeniden yapın. Eğer yönetişim nedenleriyle Azure kullanıyorsanız, bunun hâlâ liste fiyatının 4 katında ve önbellek indirimi olmadan bilinçli bir tercih olduğunu doğrulayın. Eğer bir yeniden satıcı kullanıyorsanız, önbellek aktarımının yazılı olarak sağlandığını alın. 3. Önbellek isabet oranınızı denetleyin. Doğrudan API'de, kullanım verilerinizde prompt_cache_hit_tokens değerini kontrol edin. Eğer ajan trafiğiniz %50'nin altında önbellek isabetine sahipse, istemleri statik içeriğin başta geleceği şekilde yeniden yapılandırın: 120x'lik isabet/kaçırma farkında, istem sıralaması bir bütçe kararidir.

Model ucuzladı. Bu ucuzluktan kimin faydalanacağına ilişkin dinamikler (satıcı, bulut, yeniden satıcı veya siz) bu yıl kurumsal paranın kazanılıp kaybedildiği yer olacak.

İlgili okuma: DeepSeek V4 Flash vs V4 Pro · GLM 5.2 vs DeepSeek V4 Pro · OpenRouter Fiyatlandırma Rehberi