OpenAI, 30 Temmuz 2026'da GPT-5.6 Luna'nın fiyatını %80, Terra'nınkini ise %20 düşürdü. Sol'un standart tarifesi değişmedi. Ancak çok turlu ajanlar çalıştırıyorsanız, cache-write ücretleri indirimin önemli bölümünü daha faturaya yansımadan silebilir.
30 Temmuz 2026'da ne değişti?
İndirimler 30 Temmuz 2026'da yürürlüğe girdi ve mevcut model kimlikleri için geçerli. OpenAI, hizmeti sunan sistemlerin verimliliğini artırdıktan sonra iki tarifenin düşürüldüğünü açıkladı. GPT-5.6 Sol'un standart fiyatı ise aynı kaldı.
| Model | Model kimliği | Eski girdi | Yeni girdi | Eski çıktı | Yeni çıktı |
|---|---|---|---|---|---|
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $0.20 | $6.00 | $1.20 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $2.00 | $15.00 | $12.00 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $5.00 | $30.00 | $30.00 |
Fiyatlar, kısa bağlamlı standart katmanda 1M token başınadır; kaynak OpenAI API fiyatlandırma dokümanları (31.07.2026'da doğrulandı).
“GPT-5.6 serisi ucuzladı” demek ancak kısmen doğru. OpenAI aynı gün Sol için Fast mode seçeneğini de ekledi: Temel model değişmeden, 2.5×'e kadar daha yüksek aktarım hızı karşılığında girdi $10.00, çıktı $60.00; yani standart tarifenin iki katı. Fiyatlandırma dokümanlarında Fast mode'un daha önce priority processing olarak adlandırılan özellik olduğu belirtiliyor. Başka bir deyişle, iki ekonomik katman ucuzlarken amiral gemisi katmanına daha pahalı bir seçenek geldi.
Yalın seri adı yerine açık model kimliğini kullanın. OpenAI'nin model kataloğu, gpt-5.6 adını gpt-5.6-sol için bir takma ad olarak listeliyor. Ucuz katmana gittiğini sanarak kısa adı kullanırsanız amiral gemisi fiyatından ücretlendirilirsiniz. Aracı sağlayıcılarda bu takma ad hiç bulunmayabilir: AIReiter endpoint'inde gpt-5.6, Model 'gpt-5.6' not found yanıtını veriyor (31.07.2026'da test edildi).
Geliştiricilerin odağında indirimin büyüklüğünden çok kalıcı olup olmayacağı var:
OpenAI'ın 5.6 modellerini çalıştırmanın gerçekten bu kadar az maliyetli olmasının imkânı yok — r/Anthropic başlık metni
Luna, GPT-5.4 nano'dan da ucuzken hangi katman seçilmeli?
GPT-5.6 Luna, $0.20 girdi ve $1.20 çıktı fiyatıyla artık çıktı tokenı başına gpt-5.4-nano'dan ($0.20 / $1.25) daha ucuz; gpt-5.4-mini'ye ($0.75 / $4.50) kıyasla da çok daha hesaplı. Eski nano veya mini çağrılarını yalnızca maliyet gerekçesiyle tutuyorsanız, bu gerekçe artık ortadan kalktı.
Uygun fiyatlı katmanın pratikte ne verdiğini görmek için 31.07.2026'da AIReiter'ın OpenAI uyumlu endpoint'i üzerinden üç GPT-5.6 modelini iki görevde denedim: katı şemalı destek talebi-JSON çıkarımı ve tek doğru yanıtı olan token faturalama aritmetiği sorusu ($23.71). Her görev için iki çalışma yaptım; max_tokens: 4000, yeniden deneme yok ve beklenen çıktıya göre başarılı/başarısız değerlendirmesi kullanıldı.
| Görev | Model | Girdi tokenı | Çıktı tokenı | Gecikme (çalışma 1 / çalışma 2) | Doğru |
|---|---|---|---|---|---|
| Talep → JSON | Luna | 135 | 77–78 | 4.0s / 3.5s | Evet |
| Terra | 135 | 46 | 2.1s / 2.1s | Evet | |
| Sol | 135 | 46 | 2.3s / 2.2s | Evet | |
| Faturalama aritmetiği | Luna | 119 | 111–122 | 3.1s / 4.3s | Evet |
| Terra | 119 | 87–89 | 3.8s / 2.8s | Evet | |
| Sol | 4,488 | 84–87 | 3.5s / 3.2s | Evet |
Burada özellikle öne çıkan iki sonuç var.
Çıkarım görevinde en hızlı model Luna değil, en yavaş modeldi. Luna 3.5–4.0s aralığındayken Terra 2.1s'de tamamladı. Ucuz katman otomatik olarak düşük gecikme anlamına gelmiyor.
Sol, Terra ve Luna'nın 119 olarak saydığı prompt için 4,488 girdi tokenı bildirdi. Bunların 3,840'ı cached_tokens olarak işaretlendi. Sonuç her iki çalışmada da aynen tekrarlandı. Basit bir promptta (“Reply with only the word OK.”) üç model de eşit biçimde 24 token bildirdi; dolayısıyla şişme modelden ziyade promptla ilişkili görünüyor. Token sayılarını görebiliyorum, ancak sebebini göremiyorum. Bunu modelin belgelenmiş bir özelliği değil, tek bir endpoint üzerinde ölçülmüş faturalama davranışı olarak değerlendirin.
Resmî standart tarifelerle hesaplandığında, aynı doğru yanıtın maliyeti şöyle oldu:
1.000 çalışma başına Luna $0.16, Terra $1.29, Sol ise $7.73 tuttu. Sol, aynı üç basamaklı sayıyı döndürmek için Terra'nın yaklaşık 6 katı, Luna'nın ise 47 katı ücretlendirdi.
Bu çalışma, iki kolay görev üzerinde yapılan iki turluk küçük bir örneklem; benchmark değil ve muhakeme kalitesini ölçmüyor. Yine de şu yaklaşımı destekliyor: Luna ile başlayın, yalnızca kendi trafiğinizde ölçtüğünüz başarısızlıklarda üst katmana geçin. Bu testlerde Terra zaten doğru cevap verirken Sol için fazladan ödeme yapmak hiçbir ek değer sağlamadı. İş yüklerine göre tam dağılım yazının sonundaki tabloda yer alıyor.
%80 indirim neden faturada %80 düşüşe dönüşmeyebilir?
Manşet fiyat, yeni girdi ve çıktı tokenları için geçerli. Çok turlu ajan trafiğinde ise üçüncü bir kalem, yani cache write, maliyete yön veriyor. GPT-5.6'nın üç katmanında da bir cache write, cache read'den 12.5× daha pahalı.
| Model | Önbellekli girdi (okuma) | Önbelleğe yazma | Oran |
|---|---|---|---|
| GPT-5.6 Luna | $0.02 | $0.25 | 12.5× |
| GPT-5.6 Terra | $0.20 | $2.50 | 12.5× |
| GPT-5.6 Sol | $0.50 | $6.25 | 12.5× |
OpenAI geliştirici topluluğunda 11.07.2026'da paylaşılan kontrollü bir test, bunun etkisini net biçimde gösteriyor. previous_response_id ile zincirlenen altı ardışık Responses API turunda Luna, gpt-5.4-mini'ye göre %3 daha az girdi ve %29 daha az çıktı tokenı tüketti. Buna rağmen konuşma başına maliyeti %96 daha yüksekti: $0.0332 yerine $0.0651. Luna'nın girdisinin yaklaşık %70'i cache write olarak faturalandı. Bu veriler indirim öncesine ait, ancak mekanizma değişmiş değil.
Bu uygulamadaki sorun düzeltilebiliyordu; asıl önemli nokta da bu. GPT-5.6'nın önbelleği kısmi eşleşmeleri puanlamıyor; dolayısıyla önbelleğe alınmış önekteki her değişiklik tam yeniden yazmayı tetikliyor. Yazının sahibi, büyüyen konuşma anlık görüntüsünü instructions içinde yeniden oluşturuyor ve böylece her turda öneki geçersiz kılıyordu.
Tanısal ayrım oldukça net: sabit instructions, sonraki 15 kullanıcı turunun 15'inde de önbellek isabeti sağlarken değişken instructions için bu sayı 15'te 0 oldu. Bu bağlamı developer input item içine taşımak Luna'nın %96'lık maliyet primini %16.7'ye indirdi. Yazarın kör değerlendirmesinde Luna ardından mini'den daha hızlı çalıştı ve daha yüksek puan aldı. Ne prompt_cache_key ne de açık önbellek kırılma noktaları fayda sağladı.
İndirimin gerçekten size ulaştığını varsaymadan önce şu iki adımı atın:
- Değişken her şeyi önbelleğe alınan önekten çıkarın. Sistem metni, araç tanımları ve persona en başta yer almalı ve bayt düzeyinde aynı kalmalı; konuşma durumu ise input item'lara taşınmalı.
- Dağılımı API yanıtından kontrol edin. Her çağrıda
usage.prompt_tokens_details.cached_tokensileusage.prompt_tokenskarşılaştırması, okuma payını gösterir. Uzun süre çalışan bir ajanda düşük oran, bu serideki en yüksek etkili maliyet hatasıdır.
GPT-5.6 için dolaşımda üç farklı fiyat var: Hangisi sizin için geçerli?
GPT-5.6 Luna fiyatını aradığınızda en az üç farklı rakamla karşılaşıyorsunuz. Her biri belirli bir katman için doğru olabilir veya olmuş olabilir. Bir fiyatın hangi katmana ait olduğunu kontrol etmek, görünen çelişkilerin çoğunu çözüyor.
| Gördüğünüz fiyat | Luna girdi / çıktı | Ne anlama geliyor? |
|---|---|---|
| $0.20 / $1.20 | Standart katman, kısa bağlam | Normal API çağrısı için varsayılan seçenek |
| $0.10 / $0.60 | Batch ve Flex katmanları | Eşzamansız ve düşük öncelikli işler için standart fiyatın tam yarısı |
| $0.40 / $2.40 | Fast mode | Standart fiyatın iki katı |
| $1.00 / $6.00 | 30 Temmuz öncesi standart tarife | İndirime kadar geçerliydi |
Aynı fiyatlandırma dokümanlarından iki ek ayrıntı daha var: uzun bağlamda kısa bağlamlı girdi fiyatının 2×'si, çıktı fiyatının ise 1.5×'i uygulanıyor. Luna'nın uzun bağlam satırı bu nedenle $0.40 / $1.80; $0.40 / $2.40 değil. Dokümanlar ayrıca 05.03.2026 veya sonrasında yayımlanan modeller için uygun veri yerleşimi endpoint'lerinde %10 ek ücret listeliyor; GPT-5.6'nın tamamı bu kapsama giriyor.
Bir fiyatlandırma sayfası faturanızla uyuşmuyorsa iki kontrol yeterli olur: önce sayfadaki doğrulama tarihini bulun, ardından gerçekten çağırdığınız katman için resmî fiyatlandırma dokümanları ile karşılaştırın. Toplayıcılar ve aracı sağlayıcılar kendi tarifelerini de yayımlar; bunlar eski değil, ayrı bir fiyat kategorisidir.
AIReiter'da üç GPT-5.6 katmanının fiyatı OpenAI liste fiyatının %50'si seviyesinde ve bu oran 30 Temmuz indirimini de yansıttı: GPT-5.6 Luna $0.10 / $0.60, Terra $1.00 / $6.00, Sol ise $2.50 / $15.00. Önbellekli girdi ve cache write için de aynı yarı fiyat oranı uygulanıyor.
Günde 1M girdi ve 200K çıktı tokenı işleyen bir Terra ajanı için bu, liste fiyatıyla günlük $4.40 yerine $2.20 demek; çağrı da model kimliği de aynı.
Luna'nın geniş pazardaki konumu ise ayrı bir mesele. VentureBeat'in 30 Temmuz tarihli 30 model karşılaştırmasında Luna'nın toplam $1.40 fiyatı, Gemini 3.5 Flash-Lite'ı ($2.80) ve Gemini 3.1 Flash-Lite'ı ($1.75) geride bırakıyor; ancak DeepSeek v4-flash'in ($0.42) üzerinde kalıyor. Tek kriteriniz maliyetse, en ucuz LLM API'leri OpenAI'dan gelmiyor.
SSS
GPT-5.6 Sol da ucuzladı mı?
Hayır. Sol'un standart tarifesi 1M token başına $5.00 girdi ve $30.00 çıktı olarak değişmedi. Bunun yanında, fiyatı iki katına çıkaran ve 2.5×'e kadar aktarım hızı sunan bir Fast mode eklendi.
GPT-5.6 Luna artık en ucuz API modeli mi?
Hayır. 1M token başına toplam $1.40 ile uygun fiyatlı frontier-serisi modeller arasında yer alıyor; ancak VentureBeat'in 30 Temmuz tablosunda DeepSeek v4-flash ($0.42), Xiaomi'nin MiMo-V2.5 Flash modeli ($0.40) ve DeepSeek v4-pro ($1.305) daha düşük fiyatlı görünüyor.
Bazı sayfalarda GPT-5.6 Luna için neden $1 / $6 görüyorum?
Bu, 30 Temmuz 2026 öncesindeki standart tarifeydi. Sayfanın belirttiği doğrulama tarihine bakın, ardından çağırdığınız katman için resmî fiyatlandırma dokümanlarını kontrol edin.
Fiyat indirimi Batch ve Flex için de geçerli mi?
Evet. Batch ve Flex standart fiyatın yarısı olarak belirleniyor. Bu nedenle bu katmanlarda Luna $0.10 / $0.60, Terra ise $1.00 / $6.00; buna önbellekli girdi ve cache write da dahil.
Yeni fiyattan yararlanmak için kodumu değiştirmem gerekir mi?
Hayır. İndirim, geçiş gerektirmeden mevcut gpt-5.6-luna ve gpt-5.6-terra model kimliklerine uygulanıyor. Yapmaya değer tek değişiklik, indirimin en sık kaybolduğu yer olan cache-read oranınızı denetlemek.
İş yüküne göre doğru GPT-5.6 katmanı
| İş yükü | Katman | Neden? |
|---|---|---|
| Yüksek hacimli çıkarım, etiketleme, özetleme | Luna | Her iki test görevini de geçti; 1M token başına toplam $1.40 ile artık gpt-5.4-nano'nun altında |
| Gecikmenin kritik olduğu kullanıcıya dönük çağrılar | Terra | Çıkarım testinde Luna'dan daha hızlı ölçüldü (2.1s, Luna'da 3.5–4.0s) |
| Luna kalite eşiğini kaçırdığında ilk üst seviye tercih | Terra | Sol'un toplam $35 fiyatına karşılık toplam $14 |
| Terra'nın kendi trafiğinizde ölçülebilir biçimde yetersiz kaldığı işler | Sol | Terra'nın görev başına ölçülen maliyetinin 6 katını haklı çıkarabilecek tek durum |
| Her katmandaki çok turlu ajanlar | Önce önbelleği düzeltin | Cache write, cache read'den 12.5× pahalı; kötü yapılandırılmış bir önek katman seçimini anlamsızlaştırabilir |