AIREITER

Hy3 ve DeepSeek V4 Flash: Fiyatlar, Bağlam Penceresi ve Gerçek Kullanıcı Deneyimleri

Son Güncelleme: 2026-07-29 11:44:03

Bağlamı yaklaşık 150K token'ın altında kalan bir kodlama ajanı kullanıyorsanız, token başına maliyetler neredeyse aynıyken Hy3 daha mantıklı tercih. Ancak oturumlar uzuyor, depo büyüyor veya üretimde yüksek eşzamanlılık gerekiyorsa DeepSeek V4 Flash, Hy3'ün karşılayamadığı üç avantajla öne çıkıyor: 1M token bağlam penceresi, belgelenmiş $0.0028 önbellek isabeti fiyatı ve 2.500 istek eşzamanlılık sınırı. hy3 vs deepseek v4 flash kararının kısa özeti bu. Bu değerlendirme; 14 Temmuz 2026'da DeepSeek'in resmi belgeleri ve OpenRouter'ın güncel listeleri üzerinden kontrol edilen fiyatlara, üçüncü taraf benchmark verilerine ve her iki modeli günlük kullanan Hacker News ile Reddit geliştiricilerinin geri bildirimlerine dayanıyor.

Benzer ölçek, farklı öncelikler

Tencent, nihai Hy3 sürümünü 6 Temmuz 2026'da yayımladı; bu sürüm, 23 Nisan'dan beri erişilebilen önizleme modelinin yerini aldı. Duyuruya göre model, toplam 295B ve etkin 21B parametreli bir Mixture-of-Experts mimarisi kullanıyor. Tencent'in hybrid fast-and-slow thinking adını verdiği yaklaşımda model, her istekte ne kadar akıl yürütme harcayacağına karar veriyor. Bağlam penceresi 256K token ile sınırlı. Ağırlıklar Apache 2.0 lisansıyla açık ve API, Tencent Cloud TokenHub üzerinden sunuluyor.

DeepSeek V4 Flash ise V4 ailesinin hızlı katmanı olarak Nisan 2026'da çıktı. Artificial Analysis verilerine göre o da açık ağırlıklı bir MoE model: toplam 284B, etkin 13B parametreye sahip. MIT lisanslı modelin odağı farklı: 1M token'lık bağlamı düşük maliyetle sunmak. Thinking ve non-thinking modlarını destekliyor; varsayılan mod thinking ve azami çıktı uzunluğu 384K token.

Parametre sayıları birbirine yakın görünse de tasarım hedefleri farklı. Hy3, token başına akıl yürütme kalitesine ağırlık veriyor. Flash ise bağlam uzunluğu, önbellek verimliliği ve işlem hacmine odaklanıyor. Aşağıdaki pratik farkların büyük kısmı bu ayrımdan kaynaklanıyor.

Özellik (14.07.2026 doğrulaması)Hy3DeepSeek V4 Flash
Parametreler295B toplam / 21B etkin284B toplam / 13B etkin
Bağlam penceresi256K1M (384K azami çıktı)
Akıl yürütmeHibrit hızlı/yavaş düşünmeThinking + non-thinking modları
LisansApache 2.0MIT
Çıkış tarihi6 Temmuz 2026 (önizleme: 23 Nisan)Nisan 2026
Resmi APITencent Cloud TokenHubapi.deepseek.com (OpenAI + Anthropic formatları)

Benchmark sonuçları ne anlatıyor?

Artificial Analysis Intelligence Index v4.1'de Hy3, yüksek çaba gerektiren reasoning modunda 41 puan alırken DeepSeek V4 Flash 37 puanda kalıyor. Bu endekste dört puan kayda değer bir fark; kabaca Flash ile onun altındaki modeller arasındaki mesafeye denk geliyor. Yine de burada sınıf farkından söz etmek zor. İki model de "çok yetenekli, ancak frontier değil" kategorisinde.

Artificial Analysis karşılaştırma kartlarında Intelligence Index puanları: Hy3 41, DeepSeek V4 Flash 37

Bu puana gereğinden fazla ağırlık vermeden önce iki önemli noktayı hesaba katmak gerekiyor.

İlki, ajan tabanlı kodlama benchmark'larının iki model için de daha sert bir tablo çizmesi. Hacker News'teki lansman başlığında bir yorumcu, Hy3'ün DeepSWE sonucunu buldu: %28. Aynı testte GPT-5.4, maksimum çabayla %52'ye ulaşıyor. Bu iki Çinli model de frontier ajan tabanlı kodlama seviyesinde değil; liderlik tablosunun en üstüyle değil, daha çok birbirleriyle yarışıyorlar.

İkinci olarak, her iki şirketin kendi yayımladığı benchmark tablolarına da olağan şüpheyle yaklaşmak gerek. Hy3'ün lansman rakamları HN başlığında hızla "benchmaxxed" suçlamalarına yol açtı; DeepSeek'in tabloları da yalnızca çalıştırmayı seçtiği değerlendirmeleri kapsıyor. Bu nedenle dayanak alınması gereken veriler yukarıdaki üçüncü taraf sonuçları. Onların mesajı net: Hy3 bir miktar daha akıllı, ancak fark küçük; fiyat ve bağlam gereksinimi kararı kolayca tersine çevirebilir.

Fiyatta asıl belirleyici etiket değil

14 Temmuz 2026'da kontrol edilen iki fiyat tablosunu birbirinden ayırmak gerekiyor. DeepSeek, API belgelerinde token başına birinci taraf fiyatlarını açıkça yayımlıyor. Tencent ise nihai Hy3 için buna denk bir İngilizce fiyat listesi sunmuyor; basın bülteninde TokenHub üzerindeki Hy3 preview giriş maliyeti milyon token başına yaklaşık $0.18 olarak geçiyor. Bu nedenle aşağıdaki Hy3 sütununda, birinci taraf fiyatı değil OpenRouter'ın listelenen ücretleri yer alıyor.

1M token başınaHy3 (OpenRouter pazaryeri)DeepSeek V4 Flash (birinci taraf API)
Girdi$0.14$0.14 (önbellek kaçırma)
Önbelleğe alınmış girdi$0.035$0.0028 (önbellek isabeti)
Çıktı$0.58$0.28
DeepSeek resmi fiyat tablosunda önbelleğe alınmış 1M girdi tokenı için $0.0028 ücreti

Girdi ücretleri aynı. Kararı belirleyen diğer iki satır.

Önbellek isabetinin çarpan etkisi

DeepSeek'in önbellek isabeti fiyatı, önbellek kaçırma ücretinden 50 kat; OpenRouter'daki Hy3 önbellek ücretinden ise 12,5 kat daha düşük. (Bu iki önbellek fiyatı tamamen eşdeğer değil: DeepSeek rakamı birinci taraf API ücreti, Hy3 rakamı ise OpenRouter'ın altyapı sağlayıcılarından önbellek okuması için aldığı ücret. Yine de bugün ödeyeceğiniz oranlar bunlar.) Ajan çalıştırıyorsanız, bu sayfadaki en önemli rakam bu olabilir. Bir ajan döngüsü her turda büyüyen bağlamı yeniden gönderir: sistem istemi, araç tanımları, dosya içerikleri ve konuşma geçmişi. 40 turluk bir oturumda girdi tokenlarının büyük bölümü tekrardır. Önbellek isabet oranı %90 olduğunda Flash'ın etkin girdi maliyeti milyon token başına $0.14'ten yaklaşık $0.017'ye iner. Hy3'te ise yaklaşık $0.045 olur. Hâlâ düşük bir maliyet, ancak neredeyse 3 kat fazla; oturum uzadıkça fark da açılır.

Hy3'ün pahalılaştığı yer çıktı tokenları

Her iki model de reasoning modeli olduğu için düşünme tokenlarını çıktı olarak ücretlendiriyor. Hy3'ün $0.58'lik çıktı fiyatı, Flash'ın $0.28 ücretinin iki katından fazla. Bu yüzden uzayan her akıl yürütme zinciri Hy3 kullanıcılarına kabaca iki kat maliyet çıkarıyor. Flash'ın Hy3'te olmayan bir avantajı daha var: Biçimlendirme, veri çıkarma veya basit düzenlemeler gibi mekanik işler için non-thinking moda geçerek gereksiz reasoning maliyetini kesebilirsiniz. Bu mod değişiminin pratikte nasıl çalıştığını deepseek-v4-flash-vs-deepseek-v4-pro karşılaştırmasında bulabilirsiniz.

Ücretsiz katman

Hy3'ün gerçek bir avantajı var: OpenRouter, hız limiti uygulanmış olsa da tencent/hy3:free varyantını ücretsiz sunuyor. Modeli kullanmaya karar vermeden önce değerlendirmek için bu, ücretsiz API katmanı olmayan Flash'a göre daha iyi bir seçenek. Nisan checkpoint'iyle çalışmak sizin için sorun değilse Hy3 preview, $0.063/$0.21 fiyatıyla nihai sürümden daha düşük ücretle listelenmeye devam ediyor.

Bağlam penceresinin görünmeyen maliyeti

Gerçek bir kod tabanında ajan çalıştırmaya başlayana kadar Hy3'ün 256K bağlam penceresi fazlasıyla yeterli görünebilir. Aynı harness içinde iki modeli de deneyen r/hermesagent kullanıcısı, Hy3 için "bağlam boyutu dışında neredeyse aynı, bu nedenle sık sık compaction gerekiyor" yorumunu yapıyor. Compaction yalnızca can sıkıcı değildir: Her döngü özet çıkarmak için çıktı tokenı harcar, ayrıntı kaybına neden olur ve prompt cache'i geçersiz kılar. Böylece bağlamı yeniden oluşturmak için önbellek kaçırma ücretini ödersiniz.

Kendi altyapınızda çalıştırdığınızda fark daha yapısal bir hâl alıyor. V4 mimarisinin seyrek dikkat tasarımı — DeepSeek bu mekanizmaya lightning indexer diyor — KV cache'i Hy3'ün geleneksel attention yaklaşımına kıyasla ciddi ölçüde hafifletiyor. Bunlar benchmark değil, tekil kullanıcı raporları; ancak HN başlığındaki rakamlar dikkat çekici. İki modeli de bir çift DGX Spark üzerinde çalıştıran bir yorumcu, DeepSeek V4 Flash ile birlikte 3M token KV cache sığdırabildiğini; Hy3 FP4'e quantize edildiğinde ise yaklaşık 130K token seviyesinde kaldığını bildirdi. Bir başka tahmine göre llama.cpp indexer'ı tam desteklediğinde Flash'ın tam 1M bağlamı yalnızca yaklaşık 6GB RAM gerektirebilir. Flash'ın agresif quantization altında da iyi sonuç verdiğine dair örnekler mevcut: Aynı başlıktaki birkaç kullanıcı, modelin 2-bit seviyesinde bile tutarlılığını koruduğunu söylüyor. Hy3 için henüz benzer bir sonuç gösterilmiş değil.

Kullanımınız rahatça 200K token'ın altında kalıyorsa bu bölümün size bir maliyeti yok; Hy3'ün fazladan dört intelligence puanından bedelsiz yararlanırsınız. Ancak bu sınır aşıldığında bağlam vergisi birikir: Daha fazla compaction, daha fazla önbellek geçersizleşmesi ve oturum başına daha yüksek bellek ihtiyacı.

Lansman sonrası geliştirici deneyimleri

Bulduğum en yararlı sinyal benchmark tablolarında değil. Kodlama ajanlarında iki modeli birlikte kullanan geliştiricilerin anlattığı karakter farkında.

Aynı Hacker News başlığındaki bir kullanıcı, Anthropic aboneliğini iptal ettikten sonra DeepSeek V4 Flash ve Pro'yu günlük ana modeli olarak kullanmaya başlamış, ardından Hy3'ü de denemiş. Flash için değerlendirmesi şöyle: Hızı çok iyi, ancak "sık sık tamamen yanlış bir zihinsel model kurup yanlış yola sapıyor"; düzenli düzeltme ve geçmiş compaction'ı gerekiyor. Hy3 ise bu kullanıcının deneyiminde "o kadar hızlı değil, ama şu ana kadar rotada çok daha güvenilir biçimde kalıyor" ve bağlam büyüdükçe daha az bozuluyor. Aynı başlıktaki başka kullanıcılar da Hy3'ün dünya bilgisi ve metin kalitesini, bu ölçek için Flash'tan daha iyi buluyor.

Ham kodlama çıktısında Reddit tablosu Flash lehine eğiliyor. r/LLMDevs'teki aynı görev karşılaştırması sıralamayı "DeepSeek V4 Flash > Hy3 > GLM" olarak veriyor; buna rağmen Hy3'ü "pratik kodlama iş akışları için umut verici" diye niteliyor. r/opencode tarafında ise tekrar eden görüş, Flash'ın günlük ajan işleri için "fazlasıyla yeterli" olduğu yönünde.

Operasyonel geçmiş de değerlendirmeye dahil edilmeli. Hy3'ün lansman talebi Tencent'in sunum kapasitesini aştı: HN başlığındaki kullanıcılar yoğun hız sınırlamasından söz etti. OpenRouter'ın herkese açık kullanım sıralamasını izleyen bir kullanıcı da modelin bir ay içinde zirveden 8.-9. sıraya düştüğünü, bunun doğrudan bu limitlerden kaynaklandığını belirtti. Buna karşılık DeepSeek, Flash için resmi API'sinde 2.500 istek eşzamanlılık sınırını belgeliyor; bu, V4 Pro için izin verdiği değerin beş katı. Üretim trafiğinde tedarikçilerden biri kapasite güvencelerini yayımlamış durumda, diğerinin ise tıkanıklık geçmişi var.

Hangi senaryoda hangisi seçilmeli?

  • Ajan tabanlı kodlama, ~150K token altındaki oturumlar: Hy3. Akıl yürütme kalitesi daha yüksek, görevde daha iyi kalıyor ve girdi maliyeti Flash'ın liste fiyatıyla aynı. (256K'nın tamamı yerine 150K denmesinin nedeni, ajan bağlamının hızla büyümesi; compaction başlamadan önce pay bırakmak gerekir.)
  • Uzun oturumlar, büyük depolar, büyük dokümanlarda RAG: Flash genellikle daha uygun. 1M pencere ve 50 katlık önbellek indirimi, tamamen farklı bir maliyet sınıfı oluşturuyor; Hy3'ün compaction yükü de intelligence avantajını tüketiyor.
  • Yüksek hacimli üretim API'leri: Flash. Belgelenmiş 2.500 eşzamanlılık, istikrarlı sunum geçmişi ve düşük maliyetli toplu çağrılar için non-thinking modu sunuyor.
  • Yazı, araştırma ve dünya bilgisi gerektiren işler: Hy3. Topluluk geri bildirimleri ve AA bilgi değerlendirmeleri bu ölçekte Hy3'ü öne çıkarıyor.
  • Yerel kurulum: Çoğu donanım için Flash. KV cache verimliliği ve quantization dayanıklılığı konusunda çok daha fazla saha kanıtı var; lansman başlığında alıntılanan Tencent sunum rehberi ise Hy3 için sekiz adet H20 sınıfı GPU öneriyor.
  • Karar vermeden önce denemek: Hy3'ün ücretsiz OpenRouter katmanını deneyebilirsiniz. Kendi görevlerinizi çalıştırın; bu yazı dahil hiçbir benchmark tablosuna körü körüne güvenmeyin.

Nerede kullanabilirsiniz?

DeepSeek V4 Flash: resmi API, hem OpenAI formatındaki (api.deepseek.com) hem de Anthropic formatındaki (api.deepseek.com/anthropic) endpoint'leri sunuyor. Bu sayede yalnızca base URL değişikliğiyle Claude uyumlu araçlara eklenebiliyor. Aynı fiyat sayfasındaki geçiş tarihine dikkat: Eski deepseek-chat ve deepseek-reasoner model adları 24 Temmuz 2026'da kullanımdan kalkıyor; bunlar sırasıyla Flash'ın non-thinking ve thinking modlarına eşleniyor. OpenRouter modeli $0.09/$0.18 fiyatıyla taşıyor; resmi ücretten biraz daha düşük, ancak resmi API'nin önbellek isabeti fiyatı olmadan.

Hy3: Birinci taraf seçeneği Tencent Cloud TokenHub. OpenRouter'da nihai sürüm, daha uygun fiyatlı preview checkpoint'i ve ücretsiz katman mevcut. SiliconFlow lansman kampanyaları sundu. Yeterli GPU'nuz varsa Apache 2.0 kapsamında kendi altyapınızda da çalıştırabilirsiniz. Hy3 API setup guide, anahtar alma ve ilk çağrıyı yapma sürecini anlatıyor.

SSS

Hy3'ü ücretsiz kullanabilir miyim?

Kısmen. OpenRouter, hız limiti bulunan tencent/hy3:free katmanını ücretsiz listeliyor. Tencent'in tüketici ürünleri olan Yuanbao ve ima da Hy3'ü ücretsiz kullanıyor. TokenHub veya OpenRouter'ın ücretli katmanı üzerinden üretim API erişimi ise token başına ücretlendiriliyor.

Hy3, Tencent Hunyuan ile aynı model mi?

Evet. Hy3, Tencent'in artık "Tencent Hy" markasıyla anılan Hunyuan model serisinin üçüncü nesli. Önizleme 23 Nisan 2026'da, nihai sürüm ise 6 Temmuz 2026'da yayımlandı.

Kodlama için Hy3 mü, DeepSeek V4 Flash mı daha iyi?

Topluluk sonuçları görevin yapısına göre ayrışıyor. Aynı görevde yapılan Reddit karşılaştırmaları Flash'ın ham çıktısını Hy3'ün üzerinde sıralarken, uzun oturumlarda ajan kullananlar Hy3'ün görevden daha güvenilir biçimde sapmadığını bildiriyor. Kısa ve sınırları net işler Flash'ın hızından faydalanıyor. Sapmanın maliyetli olduğu, saatler süren ajan oturumlarında ise bağlamınız 256K penceresinin rahatça içinde kaldığı sürece Hy3 daha iyi seçenek olabilir.

DeepSeek V4 Flash'ı yerelde çalıştırabilir miyim?

Evet; üstelik Hy3'e göre daha pratik. Ağırlıklar MIT lisanslı, mimarinin KV cache'i alışılmadık ölçüde hafif ve kullanıcılar ~96GB RAM bulunan makinelerde 2-bit quantization ile dahi kullanılabilir kalite bildirmiş durumda.

hy3 vs deepseek v4 flash fiyat karşılaştırması neden bu kadar karışık?

Çünkü en az dört ayrı fiyat tablosu var: Tencent TokenHub, OpenRouter'ın Hy3 nihai ve preview listeleri ile ayrı önbellek isabeti fiyatına sahip DeepSeek resmi API'si. Kendi trafik düzeniniz için etkin maliyeti karşılaştırın. Ajan iş yüklerinde önbelleğe alınmış girdi baskın hâle gelir ve DeepSeek'in $0.0028 ücreti bu noktada zor geçilir.

Sonuç

Mevcut üçüncü taraf veriler Hy3'ün daha güçlü model olduğunu gösteriyor; DeepSeek V4 Flash ise daha güçlü hizmet. Üretim API iş yüklerinde varsayılan tercihim Flash olur: Ön bellek ekonomisi, bağlam penceresi ve yayımlanmış eşzamanlılık kapasitesi, dört puanlık benchmark üstünlüğünün telafi edemeyeceği şekilde birikimli avantaj sağlıyor. Ölçekten çok istem başına akıl yürütme kalitesinin önemli olduğu durumlarda Hy3'e yönelin; kendi görevlerinizde kontrol etmek için önce ücretsiz katmanını deneyin.

İlgili okumalar