Hy3 vs DeepSeek V4 Flash: Fiyatlandırma, Bağlam, Gerçek Geri Bildirim

Son Güncelleme: 2026-07-14 13:15:02

Eğer iş yükünüz, yaklaşık 150K token’lık bağlamın altında kalan bir coding agent ise, Hy3 daha akıllı modeldir ve giriş tokenı başına maliyeti yaklaşık olarak aynıdır. Oturumlarınız uzun sürüyorsa, repo’nuz büyükse veya production’da yüksek concurrency’e ihtiyacınız varsa, DeepSeek V4 Flash, Hy3’ün eşleşemediği üç sayıda öne çıkar: 1M-token context window, belgelenmiş 0,0028 $ cache-hit fiyatı ve 2.500 istek concurrency sınırı. hy3 vs deepseek v4 flash kararının kısa özeti budur. Bunun arkasındaki kanıt: fiyatlandırma 14 Temmuz 2026’da DeepSeek’in resmi dokümanları ve OpenRouter’ın canlı listeleri, üçüncü taraf benchmark verileri ve Hacker News ile Reddit’teki geliştiricilerin her iki modeli de günlük olarak çalıştırdıktan sonra bildirdikleriyle karşılaştırılarak kontrol edildi.

İki model, iki farklı bahis

Tencent nihai Hy3’ü 6 Temmuz 2026’da yayımladı, 23 Nisan’dan beri canlı olan önizleme sürümünü güncelleyerek. Söz konusu duyuruya göre bu, toplamda 295B parametreye ve 21B aktif parametreye sahip bir Mixture-of-Experts modelidir ve Tencent’in hibrit hızlı-yavaş düşünme olarak adlandırdığı yaklaşım etrafında geliştirilmiştir: model, her istek için ne kadar akıl yürütme harcayacağına karar verir. Bağlam uzunluğu 256K token ile sınırlıdır. Ağırlıklar Apache 2.0 altında açıktır ve API Tencent Cloud TokenHub üzerinde çalışır.

DeepSeek V4 Flash Nisan 2026'da V4 ailesinin hızlı katmanı olarak kullanıma sunuldu. Ayrıca açık ağırlıklı bir MoE'dir (Artificial Analysis'e göre toplam 284B, aktif 13B) ancak MIT lisanslıdır ve farklı bir hedef için ayarlanmıştır: 1M token bağlamı düşük maliyetle sunmak. Hem düşünme hem de düşünmeme modlarını destekler (varsayılan düşünme modudur) ve maksimum çıktı 384K token'dır.

Parametre sayıları benzer görünüyor. Tasarım hedefleri ise öyle değil. Hy3, bütçesini token başına akıl yürütme kalitesine harcar; Flash ise bunu bağlam uzunluğuna, önbellek verimliliğine ve işlem hacmine harcar. Aşağıdaki pratik farkların çoğu bu ayrımdan kaynaklanır.

Teknik Özellik (2026-07-14 doğrulandı)Hy3DeepSeek V4 Flash
Parametreler295B toplam / 21B aktif284B toplam / 13B aktif
Bağlam penceresi256K1M (384K maksimum çıktı)
Akıl yürütmeHibrit hızlı/yavaş düşünmeDüşünen + düşünmeyen modlar
LisansApache 2.0MIT
Yayınlandı6 Temmuz 2026 (önizleme 23 Nis)Nisan 2026
Resmi APITencent Cloud TokenHubapi.deepseek.com (OpenAI + Anthropic formatları)

Benchmark'ların aslında gösterdiği şey

Artificial Analysis Intelligence Index v4.1'de, Hy3, yüksek çaba ile akıl yürütme modunda DeepSeek V4 Flash için 37'ye karşı 41 puan alıyor. O indekste dört puan gerçek bir farktır; kabaca Flash ile onun bir alt seviyesindeki modeller arasındaki mesafe kadardır, ancak bu bir sınıf farkı değildir. Her iki model de "çok yetenekli, öncü değil" bandında yer alıyor.

Artificial Analysis comparison cards showing Hy3 at 41 and DeepSeek V4 Flash at 37 on the Intelligence Index

O puanı fazla önemsemeden önce iki uyarı var.

Öncelikle, ajan tabanlı kodlama benchmark'ları her iki model hakkında da daha sert bir tablo ortaya koyuyor. Hacker News lansman başlığındaki bir yorumcu, Hy3'ün DeepSWE sonucunu buldu: maksimum çabayla GPT-5.4'ün %52'sine karşılık %28. Çin modellerinin hiçbiri öncü ajan tabanlı kodlamaya yaklaşmıyor; onlar liderlik tablosunun zirvesiyle değil, birbirleriyle rekabet ediyor.

İkinci olarak, her iki şirketin de yayınladığı benchmark tablolarına standart bir şüphecilikle yaklaşın. Hy3’ün lansman rakamları, HN başlığındaki “benchmaxxed” suçlamalarını hemen beraberinde getirdi ve DeepSeek’in kendi tabloları yalnızca çalıştırmayı seçtiği eval’leri kapsıyor. Yukarıdaki üçüncü taraf rakamlar, dayanak alacağım rakamlar ve şunu söylüyor: Hy3 biraz daha akıllı ve fark, fiyat ile bağlamın kararı değiştirebileceği kadar küçük.

Fiyatlandırma: etiket fiyatı bir dikkat dağıtıcıdır

14 Temmuz 2026 tarihinde kontrol edilen ve ayrı tutulması gereken iki fiyat tablosu. DeepSeek, API dokümanlarında tam birinci taraf token başına fiyatlarını yayımlar. Tencent, final Hy3 için İngilizce bir eşdeğer fiyat listesi yayımlamaz — basın bülteninde Hy3 preview giriş fiyatını TokenHub üzerinde milyon token başına yaklaşık $0.18 olarak belirtir — bu nedenle aşağıdaki Hy3 sütunu, birinci taraf olmayan bir pazar yeri fiyatı olan OpenRouter'ın listelenen oranlarını kullanır.

1M token başınaHy3 (OpenRouter marketplace)DeepSeek V4 Flash (first-party API)
Girdi$0.14$0.14 (cache miss)
Girdi, önbelleğe alınmış$0.035$0.0028 (cache hit)
Çıktı$0.58$0.28
DeepSeek official pricing table showing $0.0028 per 1M cached input tokens

Giriş fiyatları aynıdır. Karar diğer iki satırda yatıyor.

Önbellek isabet çarpanı

DeepSeek'in cache-hit fiyatı, cache-miss fiyatından 50 kat daha ucuzdur ve OpenRouter'daki Hy3'ün cached rate'inden 12.5 kat daha ucuzdur. (İki cache rate'in tam olarak eşdeğer olmadığını unutmayın — DeepSeek'inki bir first-party API fiyatıdır, Hy3'ünki ise OpenRouter'ın underlying providers'larının cache reads için ne kadar ücretlendirdiğidir — ancak bugün gerçekten ödeyeceğiniz rates bunlardır.) Agent'lar çalıştırıyorsanız bu, bu sayfadaki diğer herhangi bir sayıdan daha önemlidir. Bir agent loop, her turda sürekli büyüyen aynı context'i yeniden gönderir — system prompt, tool definitions, file contents, conversation history. 40 turluk bir session'da input tokens'larınızın büyük çoğunluğu tekrarlar olur. %90 cache-hit rate ile Flash'in effective input price'ı milyon token başına $0.14'ten yaklaşık $0.017'ye düşer. Hy3'ünki yaklaşık $0.045'e düşer — hâlâ ucuzdur, ancak neredeyse 3 kat daha pahalıdır ve session'larınız uzadıkça fark daha da büyür.

Çıktı tokenları Hy3'ün pahalı hale geldiği yerdir

Her ikisi de akıl yürütme modelleridir; bu da düşünme token'larını çıktı olarak faturalandırdıkları anlamına gelir. Hy3'ün 0,58 ABD doları çıkış oranı, Flash'ın 0,28 ABD doları oranının iki katından fazladır; bu nedenle her uzatılmış akıl yürütme zinciri Hy3 kullanıcılarına kabaca iki kat daha pahalıya mal olur. Flash ayrıca Hy3'te olmayan bir kaçış vanasına sahiptir: mekanik görevler (biçimlendirme, çıkarma, basit düzenlemeler) için düşünmeyen moda geçin ve ihtiyacınız olmayan akıl yürütme için ödeme yapmayı durdurun. deepseek-v4-flash-vs-deepseek-v4-pro karşılaştırması, bu mod değişiminin pratikte nasıl çalıştığını ele alır.

Ücretsiz katman

Hy3’ün gerçek avantajlarından biri şu: OpenRouter, tencent/hy3:free varyantını sıfır maliyetle listeliyor; hız sınırlı ama gerçek. Modele bağlanmadan önce değerlendirme yapmak için bu, ücretsiz API katmanı olmayan Flash’tan daha iyi. Hy3 preview ayrıca hâlâ $0.063/$0.21 olarak listeleniyor — son sürümün fiyatının altında — eğer Nisan checkpoint’iyle idare edebiliyorsanız.

Bağlam penceresi vergisi

Hy3'nin 256K bağlamı, bir ajanı gerçek bir kod tabanına karşı çalıştırana kadar bol gibi görünüyor. Her iki modeli aynı harness içinde çalıştıran r/hermesagent içindeki bir Reddit kullanıcısı, Hy3'ü "bağlam boyutu dışında neredeyse aynı, yani sık sık sıkıştırma" olarak nitelendirdi. Sıkıştırma, bir rahatsızlıktan daha fazlasıdır: her sıkıştırma döngüsü özetlemek için output token'ları harcar, ayrıntıları çöpe atar ve prompt cache'inizi geçersiz kılar; bu da onu yeniden oluşturmak için cache-miss oranını ödemeniz gerektiği anlamına gelir.

Eğer self-host yaparsanız fark yapısal hale gelir. V4 mimarisinin seyrek dikkat tasarımı (DeepSeek bu mekanizmaya lightning indexer diyor) KV cache’ini Hy3’ün geleneksel attention’ına kıyasla dramatik biçimde daha hafif hale getiriyor. Bunlar benchmark’lardan ziyade tekil kullanıcı raporları, ancak HN başlığındaki sayılar çarpıcı: Her ikisini de bir çift DGX Spark üzerinde çalıştıran bir yorumcu, DeepSeek V4 Flash ile birlikte 3M token KV cache sığdırabildiğini bildirdi; buna karşılık Hy3, FP4’e kuantize edildiğinde yaklaşık 130K token sığdırabiliyordu. Bir başkası, llama.cpp indexer’ı tamamen desteklediğinde Flash’in tam 1M context’inin yalnızca yaklaşık 6GB RAM gerektirmesi gerektiğini tahmin etti. Flash ayrıca agresif kuantizasyonu atlatma konusunda da bir geçmişe sahip: aynı başlıktaki birkaç kullanıcı, 2-bit’te bile tutarlı kaldığını bildiriyor; bu sonuç Hy3 için henüz gösterilmiş değil.

Kullanım durumunuz 200K token'ın oldukça altında kalıyorsa, bu bölümün tamamı size hiçbir şeye mal olmaz ve Hy3'ün dört ekstra zekâ puanı ücretsizdir. Aksi takdirde, bağlam vergisi katlanır: daha fazla sıkıştırma, daha fazla önbellek geçersiz kılma, oturum başına daha fazla bellek.

Yayınlanmasından bu yana saha raporları

Bulduğum en kullanışlı sinyal, herhangi bir benchmark tablosunda değil. Bu, geliştiricilerin iki modeli de kodlama ajanları içinde çalıştırdıklarında anlattıkları karakter farkı.

Aynı Hacker News başlığındaki bir kullanıcı, Anthropic aboneliğini iptal ettikten sonra DeepSeek V4 Flash ve Pro'ya günlük sürücüler olarak geçip ardından Hy3'ü denediğinde, Flash'i şöyle tanımladı: hız harika, ama "çoğu zaman tamamen yanlış bir zihinsel model kuruyor ve yanlış yola sapıp gidiyor," bu da düzenli düzeltme ve geçmiş sıkıştırması gerektiriyor. Kendi deneyimlerine göre Hy3 "o kadar hızlı değil, ama şimdilik çok daha güvenilir biçimde yolda kalıyor gibi görünüyor" ve bağlam büyüdükçe daha az bozuluyor. Aynı başlıktaki diğerleri, Hy3'ün dünya bilgisi ve düzyazı kalitesini, boyutuna göre Flash'inkinden daha iyi diye övdü.

Reddit'teki tablo, ham kodlama çıktısı açısından diğer yöne eğiliyor. r/LLMDevs'deki aynı görev karşılaştırması, Hy3 için hâlâ "pratik kodlama iş akışları için umut verici" derken "DeepSeek V4 Flash > Hy3 > GLM" sıralamasını yaptı. r/opencode'da tekrar eden görüş, Flash'ın günlük agent çalışmaları için "fazlasıyla yeterli" olduğu yönünde.

Dikkate alınması gereken bir operasyonel geçmiş de var. Hy3’ün lansman talebi Tencent’in sunma kapasitesini aştı: HN başlığındaki kullanıcılar yoğun oran sınırlaması bildirdi ve OpenRouter’ın herkese açık kullanım sıralamalarını takip eden biri, modelin bir ay içinde en üst sıradan 8.–9. sıraya düştüğünü ve bu düşüşü doğrudan bu sınırlamalara bağladığını belirtti. Öte yandan DeepSeek, resmi API’sinde Flash için 2.500 istek eşzamanlılık üst sınırını belgeliyor — bu, V4 Pro için izin verdiğinin beş katı. Üretim trafiği için, bu satıcılardan biri kapasite garantilerini yayımlamış durumda, diğeri ise tıkanıklık geçmişine sahip.

Nasıl seçilir

  • Ajans kodlama, ~150K token altındaki oturumlar: Hy3. Daha yüksek akıl yürütme kalitesi sunar, görevde daha iyi kalır ve giriş maliyetleri Flash’ın etiket fiyatıyla aynıdır. (150K, tam 256K yerine; çünkü ajan bağlamı hızla büyür ve compaction devreye girmeden önce boşluk payı istersiniz.)
  • Uzun oturumlar, büyük depolar, büyük belgeler üzerinde RAG: Flash genellikle daha uygun seçimdir. 1M pencere artı 50x cache indirimi bambaşka bir maliyet sınıfıdır ve Hy3’ün compaction ek yükü zekâ avantajını yer.
  • Yüksek hacimli üretim API’leri: Flash. Belgelenmiş 2,500 eşzamanlılık, istikrarlı servis geçmişi ve ucuz toplu çağrılar için non-thinking mode.
  • Yazma, araştırma, dünya bilgisi görevleri: Hy3. Topluluk raporları ve AA knowledge evals bu boyutta ikisini de onun lehine gösteriyor.
  • Yerel dağıtım: Çoğu donanım için Flash. KV cache verimliliği ve quantization dayanıklılığı için çok daha fazla saha kanıtı var; Tencent’in, lansman başlığında alıntılanan Hy3 için kendi serving guidance’ı sekiz H20-class GPU’dur.
  • Karar vermeden önce değerlendirme yapmak: Hy3’ün ücretsiz OpenRouter katmanı denemek için hiçbir şeye mal olmaz. Başkasının benchmark tablosuna inanmadan önce, buna da dahil, kendi görevlerinizi onun üzerinden çalıştırın.

Onları nerede çalıştırmalı

DeepSeek V4 Flash: resmi API, hem OpenAI biçimli (api.deepseek.com) hem de Anthropic biçimli (api.deepseek.com/anthropic) uç noktaları sunar; bu da temel URL değişikliğiyle Claude ile uyumlu araçlara entegre olabileceği anlamına gelir. Aynı fiyatlandırma sayfasındaki geçiş son tarihine dikkat edin: eski deepseek-chat ve deepseek-reasoner model adları 24 Temmuz 2026'da kullanımdan kaldırılacak ve sırasıyla Flash'ın düşünmeyen ve düşünen modlarına eşlenecektir. OpenRouter bunu $0.09/$0.18 karşılığında sunar; resmi API'nin önbellek isabeti fiyatlandırması olmaksızın da olsa, bu oran resmi tarifeden biraz daha düşüktür.

Hy3: Tencent Cloud TokenHub birinci taraf rotadır. OpenRouter, nihai sürümü, daha ucuz önizleme checkpoint’ini ve ücretsiz katmanı sunar. SiliconFlow lansman promosyonları sunmuştur. GPU'larınız varsa Apache 2.0 kapsamında kendi kendine barındırma çalışır. Hy3 API kurulum kılavuzu, bir anahtar almayı ve ilk çağrıyı yapmayı adım adım anlatır.

SSS

Hy3 kullanımı ücretsiz mi?

Kısmen. OpenRouter, sıfır maliyetle oran sınırlı bir tencent/hy3:free katmanı listeliyor ve Tencent'in tüketici ürünleri (Yuanbao, ima) Hy3'ü ücretsiz kullanıyor. TokenHub veya OpenRouter'ın ücretli katmanı üzerinden üretim API erişimi token başına ölçülür.

Hy3, Tencent Hunyuan ile aynı mı?

Evet — Hy3, Tencent'in Hunyuan model serisinin üçüncü neslidir ve Tencent artık bunu "Tencent Hy" olarak markalandırıyor. Önizleme 23 Nisan 2026'da, nihai sürüm ise 6 Temmuz 2026'da kullanıma sunuldu.

Kodlama için hangisi daha iyi, Hy3 mü yoksa DeepSeek V4 Flash mı?

Topluluk sonuçları görev türüne göre ayrışıyor. Aynı görevde Reddit karşılaştırmaları, Flash'ın ham çıktısını Hy3'ünkinden daha üst sıralara koyarken, uzun oturumlu agent kullanıcıları Hy3'ün yoldan çıkmadan daha güvenilir şekilde ilerlediğini bildiriyor. Kısa, kapsamı iyi belirlenmiş görevlerde Flash'ın hızı avantaj sağlıyor; yol sapmasının size maliyetli olduğu çok saatli agent oturumlarında ise, bağlamınız rahatça 256K penceresinin içinde kaldığı sürece, Hy3 tercih ediliyor.

DeepSeek V4 Flash’ı yerel olarak çalıştırabilir miyim?

Evet, ve Hy3'e kıyasla daha pratik. Ağırlıklar MIT lisanslı, mimarinin KV cache'i alışılmadık derecede hafif ve kullanıcılar yaklaşık ~96GB RAM'e sahip makinelerde 2-bit quantization ile bile kullanılabilir kalite bildirmektedir.

hy3 ile deepseek v4 flash fiyat karşılaştırması neden bu kadar kafa karıştırıcı?

En az dört fiyat tablosu olduğu için: Tencent TokenHub, OpenRouter’ın Hy3 final ve preview listelemeleri ve ayrı cache-hit oranına sahip DeepSeek’in resmi API’si. Kendi trafik deseniniz için etkin fiyatı karşılaştırın: cache’li input, agent iş yüklerinde baskındır ve DeepSeek’in $0.0028 oranını burada aşmak zordur.

Özet

Hy3, mevcut üçüncü taraf kanıtlarına göre daha güçlü modeldir; DeepSeek V4 Flash ise daha güçlü hizmettir. Üretim API iş yükleri için Flash benim varsayılan seçeneğimdir: önbellek ekonomisi, bağlam penceresi ve yayımlanmış eşzamanlılık kapasitesi, dört puanlık bir benchmark üstünlüğünün telafi edemeyeceği şekillerde birleşir. Prompt başına akıl yürütme kalitesi ölçekten daha önemli olduğunda Hy3’ü tercih edin — ve önce ücretsiz katmanını deneyin; çünkü kendi görevlerinizle karşılaştırmak için hiçbir maliyeti yoktur.

İlgili okuma