21 Temmuz 2026'da yayınlanan Gemini 3.6 Flash, büyük ölçekli ajan sistemleri çalıştıranlar için iki kritik değişiklik getirdi: 1 milyon çıktı tokenı fiyatı $9.00'dan $7.50'a düştü; model aynı işi yaklaşık %17 daha az çıktı tokenıyla tamamlayabiliyor. Bu iki avantaj birleştiğinde, çıktının ağırlıkta olduğu iş yüklerinde görev başı maliyet kabaca üçte bir azalabiliyor. Kodlama ve ajan odaklı testlerde eski 3.5 Flash'ı, testlerin çoğunda ise daha büyük Gemini 3.1 Pro'yu geride bırakıyor. Halihazırda 3.5 Flash kullananlar için neredeyse bedelsiz bir yükseltme sayılır; ancak sınıfının etiket fiyatı en düşük modeli değil.
21 Temmuz'da Google neleri yayınladı?
Google aynı anda, farklı kullanım senaryolarına hitap eden üç model duyurdu:
- Gemini 3.6 Flash (
gemini-3.6-flash): Hızdan ödün vermeden güçlü performans hedefleyen ana model. 1M token bağlam penceresi, 64k azami çıktı ve Ocak 2025'ten Mart 2026'ya çekilmiş bilgi kesim tarihi sunuyor. - Gemini 3.5 Flash-Lite: Saniyede yaklaşık 350 çıktı tokenı üreten, basit ve yüksek hacimli işler için çok daha düşük fiyatlı yüksek işlem kapasiteli model.
- Gemini 3.5 Flash Cyber: Açıkları bulmak, doğrulamak ve yamalamak üzere güvenlik odaklı eğitilmiş varyant. CodeMender içinde çalışıyor; genel kullanıma açılmış değil, kamu kurumları ve güvenilir ortaklara yönelik sınırlı erişimli bir pilot program.
Resmi model sayfası 3.6 Flash'ı “hız için geliştirdiğimiz en akıllı model” olarak tanımlıyor. Fiyatlar da Google'ın Gemini API fiyatlandırma sayfasında yayımlandı.
Bu duyuru boşlukta gelmedi. Google'ın amiral gemisi Gemini 3.5 Pro planlanandan geç kaldı; DeepMind ise Gemini 4'ün ön eğitiminin başladığını açıkladı. Flash güncellemesi, daha büyük modeller gelene kadar bu boşluğu dolduruyor.
Gemini 3.6 Flash fiyatı: İndirim göründüğü kadar büyük değil
Gemini 3.6 Flash'ın standart API tarifesi, 1M girdi tokenı için $1.50, 1M çıktı tokenı için $7.50. Çıktı fiyatına düşünme tokenları da dahil. Bağlam önbellekleme 1M token başına $0.15, depolama ise 1M token/saat başına $1.00.
Lansman yazılarının çoğunda atlanan detay şu: İndirim yalnızca çıktıda var. Önceki Gemini 3.5 Flash, girdi için $1.50, çıktı için $9.00 alıyordu. Girdi fiyatı değişmedi; çıktı $9.00'dan $7.50'a indi. Yani genel bir indirim değil, %16.7'lik çıktı indirimi söz konusu. Uzun belgeleri işleyip kısa cevaplar üreten, girdi ağırlıklı iş yüklerinde etiket fiyatından doğacak tasarruf sınırlı kalır. Asıl kazanç başka noktada ortaya çıkıyor.
Asıl ölçüt token fiyatı değil, görev başı maliyet
Model nesillerini karşılaştırırken token başı etiket fiyatına bakmak yeterli değil. Ödeme, fiyat × kullanılan token miktarı üzerinden hesaplanır. Burada iki değişken var: Çıktı birim fiyatı %16.7 daha düşük ve Google'ın Artificial Analysis Index üzerinden paylaştığı verilere göre model aynı iş için yaklaşık %17 daha az çıktı tokenı kullanıyor. En iyi senaryoda hesap 0.833 × 0.83 ≈ 0.69 oluyor; yani çıktı maliyeti yaklaşık %31 düşebiliyor.
Gerçekte görülecek tasarruf iş yüküne bağlı. Bu nedenle 22 Temmuz 2026'da, sıcaklık değeri 0 iken aynı üç istemi (bir kodlama görevi, bir muhakeme problemi ve bir JSON çıkarma işi) OpenRouter üzerinden iki modelde de çalıştırdım:
| Metrik (3 görev, temp 0) | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|
| Girdi tokenı | 146 | 145 |
| Çıktı tokenı | 2,736 | 2,593 |
| Toplam maliyet | $0.0207 | $0.0236 |
| Toplam gecikme | 5.20s | 5.19s |
Her iki model de doğru ve birbiriyle karşılaştırılabilir yanıtlar verdi. Bu küçük örneklemde 3.6 Flash, neredeyse aynı hızda yaklaşık %12 daha ucuza geldi; ancak muhakemeye daha fazla yer ayırdığı için birkaç yüzde puan daha fazla token üretti. Sonuç net: Güvenilir tasarruf çıktı fiyatındaki düşüşten ($9.00'dan $7.50'a) geliyor. Token verimliliği artışı toplamda gerçek, fakat göreve göre değişkenlik gösteriyor ve her zaman görünmeyebilir. Pratikte çıktı tarafında %12–17 tasarruf planlamak mantıklı; %31 ise en iyi senaryo olarak görülmeli.
(Küçük örneklem: üç görev, sıcaklık değeri 0; resmi bir benchmark değil.)
Gemini 3.6 Flash, diğer hızlı modellerin neresinde?
Token başına en ucuz model, her zaman en iyi fiyat/performans seçeneği değildir. Hızlı model segmentini yan yana görmek bu yüzden faydalı. Tüm rakamlar, sağlayıcıların resmi fiyat sayfalarındaki standart, yani batch olmayan, 1M token fiyatlarıdır.
| Model | Girdi /1M | Çıktı /1M | Bağlam |
|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | 1M |
| Gemini 3.5 Flash (önceki) | $1.50 | $9.00 | 1M |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | 1M |
| Claude Haiku 4.5 | $1.00 | $5.00 | 200k |
| GPT-5.6 Luna | $1.00 | $6.00 | — |
| DeepSeek V4 Flash | $0.14 | $0.28 | 1M |
Yalnızca etiket fiyatına bakılırsa 3.6 Flash lider değil. Claude Haiku 4.5 ve GPT-5.6 Luna çıktı tarafında daha ucuz; DeepSeek V4 Flash ise maliyet açısından bambaşka bir seviyede. 3.6 Flash'ın sunduğu değer, dolar başına zekâ performansı: Tam 1M token bağlam penceresi ve saniyede yaklaşık 304 çıktı tokenıyla, hızlı model segmenti medyanının belirgin biçimde üzerinde 50'lik bir Artificial Analysis Intelligence Index puanı alıyor. Amiral gemisi fiyatlarını ödemeden üst düzey ajan ve kodlama kalitesi gerekiyorsa, tercih gerekçesi bu. Basit görevlerde mutlak en düşük maliyet aranıyorsa daha ucuz satırlar öne çıkar.
3.5 Flash'a göre ne kadar ileride?
Nesil farkı belirgin ve en büyük sıçrama, Flash serisinin eskiden daha zayıf kaldığı uzun soluklu kodlama ve ajan görevlerinde görülüyor.
| Benchmark | Gemini 3.5 Flash | Gemini 3.6 Flash |
|---|---|---|
| DeepSWE v1.1 | 37% | 49% |
| MLE-Bench | 49.7% | 63.9% |
| OSWorld-Verified (bilgisayar kullanımı) | 78.4% | 83.0% |
| SWE-Bench Pro | 55.1% | 58.7% |
| Terminal-Bench 2.1 | 76.2% | 78.0% |
Puanlar Google DeepMind Flash model sayfasından ve Artificial Analysis'ten alınmıştır. DeepSWE'de 12 puanlık, MLE-Bench'te ise 14 puanlık artış özellikle dikkat çekiyor. Google ayrıca GDPval-AA bilgi işi puanının 1349'dan 1421'e çıktığını bildiriyor. 3.6 Flash, bu testlerin birkaçında daha büyük ve pahalı 3.1 Pro'yu da geçiyor; bir Flash modeli için alışılmadık bir sonuç.
Gemini 3.6 Flash ve 3.1 Pro karşı karşıya
İşin şaşırtıcı tarafı şu: Bu hızlı segment model, ajan ve kodlama işlerinde Google'ın daha büyük ve daha pahalı 3.1 Pro modelini geride bırakıyor. Gemini 3.1 Pro Preview, istem uzunluğuna göre katmanlı şekilde 1M token için $2.00–$4.00 girdi ve $12.00–$18.00 çıktı fiyatlandırmasına sahip. 3.6 Flash'ta ise fiyat sabit: $1.50/$7.50.
| Gemini 3.6 Flash | Gemini 3.1 Pro | |
|---|---|---|
| Girdi /1M | $1.50 | $2.00–$4.00 |
| Çıktı /1M | $7.50 | $12.00–$18.00 |
| DeepSWE v1.1 | 49% | 12% |
| SWE-Bench Pro | 58.7% | 54.2% |
| Terminal-Bench 2.1 | 78.0% | 73.8% |
3.1 Pro hâlâ daha büyük ve pahalı model; en zor muhakeme ve uzun bağlam gerektiren işler için konumlanıyor. Ancak çoğu kodlama ve ajan iş yükünde 3.6 Flash, yukarıdaki benchmark'larda hem daha ucuz hem de daha yüksek puanlı. Bu nedenle varsayılan olarak Pro katmanına yönelmeden önce 3.1 Pro karşılaştırmasını çalıştırmak önemli. Gemini 3.6 Flash vs 3.1 Pro karşılaştırmasının tamamında bire bir benchmark'lar, katmanlı fiyatlandırma ve uygulamalı hız testi yer alıyor.
Gemini 3.5 Flash'tan geçiş yapmalı mısınız?
3.5 Flash kullanan ekiplerin çoğu için yanıt evet. Hesap neredeyse her açıdan daha avantajlı:
- Girdi fiyatı aynı ($1.50/1M), çıktı fiyatı daha düşük ($7.50 yerine $9.00).
- Aynı görev için daha az çıktı tokenı kullanıyor (yaklaşık %17 daha az).
- Bilgi kesim tarihi daha yeni (Ocak 2025 yerine Mart 2026).
- Daha yüksek benchmark sonuçları: Yukarıdaki tüm ajan ve kodlama testlerinde önde.
Yine de üretimde modeli değiştirmeden önce iki noktayı kontrol edin. İlk olarak, iş yüklerinizin 64k azami çıktı sınırına uyduğundan emin olun; daha uzun tekil yanıtlar kullanıyorsanız bu sınırı test edin. İkinci olarak kendi değerlendirme setinizi çalıştırın. Token verimliliğindeki ve muhakemedeki değişimler, önceden optimize ettiğiniz istemlerde davranışı etkileyebilir. Varsayılan modeli değiştirmeden önce kendi trafiğinizde gecikmeyi ve çıktı kalitesini ölçün.
Flash, Flash-Lite ve Cyber: Hangisi hangi iş için?
Üç model, üç farklı ihtiyaç:
- Gemini 3.6 Flash varsayılan tercih. Hızlı model segmenti fiyatında, üst düzey ajan, kodlama ve çok modlu kalite istiyorsanız buna yönelin.
- Gemini 3.5 Flash-Lite ($0.30/$2.50, ~350 token/sn); sınıflandırma, çıkarma, yönlendirme ve basit sohbet gibi yüksek hacimli, gecikmeye duyarlı ve düşük karmaşıklıktaki işler için uygun. Gemini'yi büyük ölçekte çalıştırmanın en düşük maliyetli yolu.
- Gemini 3.5 Flash Cyber yalnızca bir kamu kurumu ya da doğrulanmış bir güvenlik ortağıysanız anlamlı. CodeMender içindeki bir pilot program; standart API üzerinden çağırabileceğiniz bir model değil.
Gemini 3.6 Flash'a nasıl erişilir?
Model, Gemini API ve Google AI Studio'da kullanıma açıldı. AI Studio'da prototipleme için kullanım limitli ücretsiz katman var; ardından Gemini serisinin geri kalanında da geçerli olan ücretsizden ücretliye Google AI Studio akışıyla, gemini-3.6-flash model kimliğini kullanarak kullandıkça öde tarifesine geçebilirsiniz. Kurumsal yüzeyler arasında Antigravity, Android Studio ve Gemini Enterprise Agent Platform da listeleniyor. Özellikle Vertex AI üzerinde kullanmanız gerekiyorsa Vertex konsolundaki listeyi doğrulayın; çünkü 22 Temmuz 2026 itibarıyla erişim hâlâ aşamalı olarak açılıyordu.
Gemini API için en temel REST çağrısı şöyle görünüyor:
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"contents":[{"parts":[{"text":"Summarize agentic AI in one sentence."}]}]}'
Birden fazla sağlayıcıyla çalışan ekipler, ayrı ayrı anahtar yönetmek yerine modelleri bazen bir toplayıcı üzerinden yönlendiriyor. Hem OpenRouter hem de AIReiter, gemini-3.6-flash modelini Google'ın liste fiyatıyla sunuyor; fark, aynı anahtarın arkasında bulunan diğer seçeneklerde. OpenRouter çok sayıda sağlayıcıya dağıtım yaparken AIReiter, Anthropic uyumlu yapısıyla Gemini'yi Claude ile birlikte yönlendiriyor. Bu, 3.6 Flash'ı Claude API fiyatlandırmasıyla tek faturada değerlendirmek isteyenler için faydalı olabilir. Tek modelle çalışan bir dağıtımda ise doğrudan Google'a gitmek daha basit.
Sık sorulan sorular
Gemini 3.6 Flash ücretsiz mi?
Google AI Studio'da, kullanım limitleri bulunan bir prototipleme ücretsiz katmanı mevcut. Üretim kullanımı ise 1M token başına $1.50 girdi ve $7.50 çıktı üzerinden kullandıkça öde tarifesiyle fiyatlandırılıyor.
Gemini 3.6 Flash, 3.5 Flash'tan daha mı iyi?
Evet. Yayımlanan benchmark'larda DeepSWE, MLE-Bench, OSWorld-Verified, SWE-Bench Pro ve Terminal-Bench testlerinin tamamında 3.5 Flash'ı geçiyor. Üstelik çıktı tokenı başına daha düşük maliyetli ve görev başına daha az token kullanıyor.
Gemini 3.6 Flash, Gemini 3.1 Pro'dan daha mı iyi?
DeepSWE, SWE-Bench Pro ve Terminal-Bench gibi ajan ve kodlama benchmark'larında evet; üstelik daha düşük fiyatla ($1.50/$7.50 yerine $2.00–$4.00/$12.00–$18.00). Gemini 3.1 Pro daha büyük model ve en zor uzun bağlamlı muhakeme ile çok modlu görevlerde hâlâ önde. Dolayısıyla doğru seçim iş yükünüze bağlı.
Gemini 3.6 Flash'ın fiyatı ne kadar?
Standart katmanda 1M girdi tokenı $1.50, 1M çıktı tokenı $7.50. Bağlam önbellekleme fiyatı ise 1M token başına $0.15.
Gemini 3.6 Flash'ın bilgi kesim tarihi nedir?
Mart 2026. Önceki Gemini 3.5 Flash'ta bu tarih Ocak 2025'ti.
Gemini 3.6 Flash Vertex AI'da kullanılabiliyor mu?
Gemini API ve Google AI Studio'nun yanı sıra çeşitli kurumsal yüzeylerde kullanımı doğrulandı. Vertex AI erişimi lansmanda açıkça doğrulanmamıştı; bu nedenle orada geliştirmeye başlamadan önce Vertex model kataloğunu kontrol edin.
Gemini 3.5 Flash Cyber nedir?
Yazılım açıklarını tespit etmek, doğrulamak ve yamalamak için ayarlanmış güvenlik odaklı bir varyant. Google DeepMind'ın CodeMender ajanı içinde çalışıyor; herkese açık bir model olmaktan ziyade kamu kurumları ve güvenilir ortaklara yönelik sınırlı erişimli bir pilot program.
