AIREITER

AI Görsel

FLUX.2 ProGPT-Image 2Wan 2.7 Image ProGPT 4o ImageSeedream 5.0 ProSeedream V5 liteSeedream V4.5Daha fazla

AI Video

Kling 3.0 Motion ControlSora 2 ProKling 3.0 TurboSora 2Kling 3.0Grok Imagine 1.5Veo 3.1Daha fazla

LLM

Gemini 3.6 FlashGemini 3.1 ProKimi K3Gemini 3 ProGemini 2.5 ProClaude Opus 5Claude Fable 5Daha fazla
YakındaSeedance 2.5
Super ResolutionLyric Video GeneratorGPT Image 2 1K GeneratorGPT Image 2 Product Mockup GeneratorUse GPT-5.6 Online
API DOKÜMANLARIFİYATLANDIRMA
BlogGüncellemelerLLM API GuideClaude API GuideKimi K3 API Guide
ŞABLONLAR
  • AIReiter
  • Blog
  • GPT-5.6 İndirimi: Luna ve Terra Artık Gerçekte Ne Kadar?

GPT-5.6 İndirimi: Luna ve Terra Artık Gerçekte Ne Kadar?

Son Güncelleme: 2026-07-31 10:58:59

OpenAI, 30 Temmuz 2026'da GPT-5.6 Luna'nın fiyatını %80, Terra'nınkini ise %20 düşürdü. Sol'un standart tarifesi değişmedi. Ancak çok turlu ajanlar çalıştırıyorsanız, cache-write ücretleri indirimin önemli bölümünü daha faturaya yansımadan silebilir.

30 Temmuz 2026'da ne değişti?

İndirimler 30 Temmuz 2026'da yürürlüğe girdi ve mevcut model kimlikleri için geçerli. OpenAI, hizmeti sunan sistemlerin verimliliğini artırdıktan sonra iki tarifenin düşürüldüğünü açıkladı. GPT-5.6 Sol'un standart fiyatı ise aynı kaldı.

ModelModel kimliğiEski girdiYeni girdiEski çıktıYeni çıktı
GPT-5.6 Lunagpt-5.6-luna$1.00$0.20$6.00$1.20
GPT-5.6 Terragpt-5.6-terra$2.50$2.00$15.00$12.00
GPT-5.6 Solgpt-5.6-sol$5.00$5.00$30.00$30.00

Fiyatlar, kısa bağlamlı standart katmanda 1M token başınadır; kaynak OpenAI API fiyatlandırma dokümanları (31.07.2026'da doğrulandı).

gpt-5.6-sol, gpt-5.6-terra ve gpt-5.6-luna için 1M token başına ücretleri gösteren OpenAI API fiyat tablosu

“GPT-5.6 serisi ucuzladı” demek ancak kısmen doğru. OpenAI aynı gün Sol için Fast mode seçeneğini de ekledi: Temel model değişmeden, 2.5×'e kadar daha yüksek aktarım hızı karşılığında girdi $10.00, çıktı $60.00; yani standart tarifenin iki katı. Fiyatlandırma dokümanlarında Fast mode'un daha önce priority processing olarak adlandırılan özellik olduğu belirtiliyor. Başka bir deyişle, iki ekonomik katman ucuzlarken amiral gemisi katmanına daha pahalı bir seçenek geldi.

30 Temmuz öncesi ve sonrası GPT-5.6 modellerinin 1M token başına toplam girdi artı çıktı fiyatlarını karşılaştıran gruplanmış çubuk grafik

Yalın seri adı yerine açık model kimliğini kullanın. OpenAI'nin model kataloğu, gpt-5.6 adını gpt-5.6-sol için bir takma ad olarak listeliyor. Ucuz katmana gittiğini sanarak kısa adı kullanırsanız amiral gemisi fiyatından ücretlendirilirsiniz. Aracı sağlayıcılarda bu takma ad hiç bulunmayabilir: AIReiter endpoint'inde gpt-5.6, Model 'gpt-5.6' not found yanıtını veriyor (31.07.2026'da test edildi).

Geliştiricilerin odağında indirimin büyüklüğünden çok kalıcı olup olmayacağı var:

OpenAI'ın 5.6 modellerini çalıştırmanın gerçekten bu kadar az maliyetli olmasının imkânı yok — r/Anthropic başlık metni

Luna, GPT-5.4 nano'dan da ucuzken hangi katman seçilmeli?

GPT-5.6 Luna, $0.20 girdi ve $1.20 çıktı fiyatıyla artık çıktı tokenı başına gpt-5.4-nano'dan ($0.20 / $1.25) daha ucuz; gpt-5.4-mini'ye ($0.75 / $4.50) kıyasla da çok daha hesaplı. Eski nano veya mini çağrılarını yalnızca maliyet gerekçesiyle tutuyorsanız, bu gerekçe artık ortadan kalktı.

Uygun fiyatlı katmanın pratikte ne verdiğini görmek için 31.07.2026'da AIReiter'ın OpenAI uyumlu endpoint'i üzerinden üç GPT-5.6 modelini iki görevde denedim: katı şemalı destek talebi-JSON çıkarımı ve tek doğru yanıtı olan token faturalama aritmetiği sorusu ($23.71). Her görev için iki çalışma yaptım; max_tokens: 4000, yeniden deneme yok ve beklenen çıktıya göre başarılı/başarısız değerlendirmesi kullanıldı.

GörevModelGirdi tokenıÇıktı tokenıGecikme (çalışma 1 / çalışma 2)Doğru
Talep → JSONLuna13577–784.0s / 3.5sEvet
Terra135462.1s / 2.1sEvet
Sol135462.3s / 2.2sEvet
Faturalama aritmetiğiLuna119111–1223.1s / 4.3sEvet
Terra11987–893.8s / 2.8sEvet
Sol4,48884–873.5s / 3.2sEvet

Burada özellikle öne çıkan iki sonuç var.

Çıkarım görevinde en hızlı model Luna değil, en yavaş modeldi. Luna 3.5–4.0s aralığındayken Terra 2.1s'de tamamladı. Ucuz katman otomatik olarak düşük gecikme anlamına gelmiyor.

Sol, Terra ve Luna'nın 119 olarak saydığı prompt için 4,488 girdi tokenı bildirdi. Bunların 3,840'ı cached_tokens olarak işaretlendi. Sonuç her iki çalışmada da aynen tekrarlandı. Basit bir promptta (“Reply with only the word OK.”) üç model de eşit biçimde 24 token bildirdi; dolayısıyla şişme modelden ziyade promptla ilişkili görünüyor. Token sayılarını görebiliyorum, ancak sebebini göremiyorum. Bunu modelin belgelenmiş bir özelliği değil, tek bir endpoint üzerinde ölçülmüş faturalama davranışı olarak değerlendirin.

Resmî standart tarifelerle hesaplandığında, aynı doğru yanıtın maliyeti şöyle oldu:

Luna, Terra ve Sol için aynı görevde 1.000 çalışma başına ölçülen maliyeti gösteren çubuk grafik

1.000 çalışma başına Luna $0.16, Terra $1.29, Sol ise $7.73 tuttu. Sol, aynı üç basamaklı sayıyı döndürmek için Terra'nın yaklaşık 6 katı, Luna'nın ise 47 katı ücretlendirdi.

Bu çalışma, iki kolay görev üzerinde yapılan iki turluk küçük bir örneklem; benchmark değil ve muhakeme kalitesini ölçmüyor. Yine de şu yaklaşımı destekliyor: Luna ile başlayın, yalnızca kendi trafiğinizde ölçtüğünüz başarısızlıklarda üst katmana geçin. Bu testlerde Terra zaten doğru cevap verirken Sol için fazladan ödeme yapmak hiçbir ek değer sağlamadı. İş yüklerine göre tam dağılım yazının sonundaki tabloda yer alıyor.

%80 indirim neden faturada %80 düşüşe dönüşmeyebilir?

Manşet fiyat, yeni girdi ve çıktı tokenları için geçerli. Çok turlu ajan trafiğinde ise üçüncü bir kalem, yani cache write, maliyete yön veriyor. GPT-5.6'nın üç katmanında da bir cache write, cache read'den 12.5× daha pahalı.

ModelÖnbellekli girdi (okuma)Önbelleğe yazmaOran
GPT-5.6 Luna$0.02$0.2512.5×
GPT-5.6 Terra$0.20$2.5012.5×
GPT-5.6 Sol$0.50$6.2512.5×

OpenAI geliştirici topluluğunda 11.07.2026'da paylaşılan kontrollü bir test, bunun etkisini net biçimde gösteriyor. previous_response_id ile zincirlenen altı ardışık Responses API turunda Luna, gpt-5.4-mini'ye göre %3 daha az girdi ve %29 daha az çıktı tokenı tüketti. Buna rağmen konuşma başına maliyeti %96 daha yüksekti: $0.0332 yerine $0.0651. Luna'nın girdisinin yaklaşık %70'i cache write olarak faturalandı. Bu veriler indirim öncesine ait, ancak mekanizma değişmiş değil.

Bu uygulamadaki sorun düzeltilebiliyordu; asıl önemli nokta da bu. GPT-5.6'nın önbelleği kısmi eşleşmeleri puanlamıyor; dolayısıyla önbelleğe alınmış önekteki her değişiklik tam yeniden yazmayı tetikliyor. Yazının sahibi, büyüyen konuşma anlık görüntüsünü instructions içinde yeniden oluşturuyor ve böylece her turda öneki geçersiz kılıyordu.

Tanısal ayrım oldukça net: sabit instructions, sonraki 15 kullanıcı turunun 15'inde de önbellek isabeti sağlarken değişken instructions için bu sayı 15'te 0 oldu. Bu bağlamı developer input item içine taşımak Luna'nın %96'lık maliyet primini %16.7'ye indirdi. Yazarın kör değerlendirmesinde Luna ardından mini'den daha hızlı çalıştı ve daha yüksek puan aldı. Ne prompt_cache_key ne de açık önbellek kırılma noktaları fayda sağladı.

İndirimin gerçekten size ulaştığını varsaymadan önce şu iki adımı atın:

  1. Değişken her şeyi önbelleğe alınan önekten çıkarın. Sistem metni, araç tanımları ve persona en başta yer almalı ve bayt düzeyinde aynı kalmalı; konuşma durumu ise input item'lara taşınmalı.
  2. Dağılımı API yanıtından kontrol edin. Her çağrıda usage.prompt_tokens_details.cached_tokens ile usage.prompt_tokens karşılaştırması, okuma payını gösterir. Uzun süre çalışan bir ajanda düşük oran, bu serideki en yüksek etkili maliyet hatasıdır.

GPT-5.6 için dolaşımda üç farklı fiyat var: Hangisi sizin için geçerli?

GPT-5.6 Luna fiyatını aradığınızda en az üç farklı rakamla karşılaşıyorsunuz. Her biri belirli bir katman için doğru olabilir veya olmuş olabilir. Bir fiyatın hangi katmana ait olduğunu kontrol etmek, görünen çelişkilerin çoğunu çözüyor.

Gördüğünüz fiyatLuna girdi / çıktıNe anlama geliyor?
$0.20 / $1.20Standart katman, kısa bağlamNormal API çağrısı için varsayılan seçenek
$0.10 / $0.60Batch ve Flex katmanlarıEşzamansız ve düşük öncelikli işler için standart fiyatın tam yarısı
$0.40 / $2.40Fast modeStandart fiyatın iki katı
$1.00 / $6.0030 Temmuz öncesi standart tarifeİndirime kadar geçerliydi

Aynı fiyatlandırma dokümanlarından iki ek ayrıntı daha var: uzun bağlamda kısa bağlamlı girdi fiyatının 2×'si, çıktı fiyatının ise 1.5×'i uygulanıyor. Luna'nın uzun bağlam satırı bu nedenle $0.40 / $1.80; $0.40 / $2.40 değil. Dokümanlar ayrıca 05.03.2026 veya sonrasında yayımlanan modeller için uygun veri yerleşimi endpoint'lerinde %10 ek ücret listeliyor; GPT-5.6'nın tamamı bu kapsama giriyor.

Bir fiyatlandırma sayfası faturanızla uyuşmuyorsa iki kontrol yeterli olur: önce sayfadaki doğrulama tarihini bulun, ardından gerçekten çağırdığınız katman için resmî fiyatlandırma dokümanları ile karşılaştırın. Toplayıcılar ve aracı sağlayıcılar kendi tarifelerini de yayımlar; bunlar eski değil, ayrı bir fiyat kategorisidir.

AIReiter'da üç GPT-5.6 katmanının fiyatı OpenAI liste fiyatının %50'si seviyesinde ve bu oran 30 Temmuz indirimini de yansıttı: GPT-5.6 Luna $0.10 / $0.60, Terra $1.00 / $6.00, Sol ise $2.50 / $15.00. Önbellekli girdi ve cache write için de aynı yarı fiyat oranı uygulanıyor.

Luna, Terra ve Sol için resmî GPT-5.6 API fiyatları ile AIReiter ücretlerini karşılaştıran AIReiter fiyat tablosu

Günde 1M girdi ve 200K çıktı tokenı işleyen bir Terra ajanı için bu, liste fiyatıyla günlük $4.40 yerine $2.20 demek; çağrı da model kimliği de aynı.

Luna'nın geniş pazardaki konumu ise ayrı bir mesele. VentureBeat'in 30 Temmuz tarihli 30 model karşılaştırmasında Luna'nın toplam $1.40 fiyatı, Gemini 3.5 Flash-Lite'ı ($2.80) ve Gemini 3.1 Flash-Lite'ı ($1.75) geride bırakıyor; ancak DeepSeek v4-flash'in ($0.42) üzerinde kalıyor. Tek kriteriniz maliyetse, en ucuz LLM API'leri OpenAI'dan gelmiyor.

SSS

GPT-5.6 Sol da ucuzladı mı?

Hayır. Sol'un standart tarifesi 1M token başına $5.00 girdi ve $30.00 çıktı olarak değişmedi. Bunun yanında, fiyatı iki katına çıkaran ve 2.5×'e kadar aktarım hızı sunan bir Fast mode eklendi.

GPT-5.6 Luna artık en ucuz API modeli mi?

Hayır. 1M token başına toplam $1.40 ile uygun fiyatlı frontier-serisi modeller arasında yer alıyor; ancak VentureBeat'in 30 Temmuz tablosunda DeepSeek v4-flash ($0.42), Xiaomi'nin MiMo-V2.5 Flash modeli ($0.40) ve DeepSeek v4-pro ($1.305) daha düşük fiyatlı görünüyor.

Bazı sayfalarda GPT-5.6 Luna için neden $1 / $6 görüyorum?

Bu, 30 Temmuz 2026 öncesindeki standart tarifeydi. Sayfanın belirttiği doğrulama tarihine bakın, ardından çağırdığınız katman için resmî fiyatlandırma dokümanlarını kontrol edin.

Fiyat indirimi Batch ve Flex için de geçerli mi?

Evet. Batch ve Flex standart fiyatın yarısı olarak belirleniyor. Bu nedenle bu katmanlarda Luna $0.10 / $0.60, Terra ise $1.00 / $6.00; buna önbellekli girdi ve cache write da dahil.

Yeni fiyattan yararlanmak için kodumu değiştirmem gerekir mi?

Hayır. İndirim, geçiş gerektirmeden mevcut gpt-5.6-luna ve gpt-5.6-terra model kimliklerine uygulanıyor. Yapmaya değer tek değişiklik, indirimin en sık kaybolduğu yer olan cache-read oranınızı denetlemek.

İş yüküne göre doğru GPT-5.6 katmanı

İş yüküKatmanNeden?
Yüksek hacimli çıkarım, etiketleme, özetlemeLunaHer iki test görevini de geçti; 1M token başına toplam $1.40 ile artık gpt-5.4-nano'nun altında
Gecikmenin kritik olduğu kullanıcıya dönük çağrılarTerraÇıkarım testinde Luna'dan daha hızlı ölçüldü (2.1s, Luna'da 3.5–4.0s)
Luna kalite eşiğini kaçırdığında ilk üst seviye tercihTerraSol'un toplam $35 fiyatına karşılık toplam $14
Terra'nın kendi trafiğinizde ölçülebilir biçimde yetersiz kaldığı işlerSolTerra'nın görev başına ölçülen maliyetinin 6 katını haklı çıkarabilecek tek durum
Her katmandaki çok turlu ajanlarÖnce önbelleği düzeltinCache write, cache read'den 12.5× pahalı; kötü yapılandırılmış bir önek katman seçimini anlamsızlaştırabilir

>_AIReiter Model Dizini

Bu rehberle ilgili modellere hızlı API erişimi

GPT-5.6 Luna

Chat

Günlük kodlama, yazma ve ajan iş akışları için dengeli bir GPT-5.6 metin modeli.

OpenAIAPI Key oluştur >

GPT-5.6 Terra

Chat

Akıl yürütme ağırlıklı kodlama ve analiz görevleri için daha güçlü bir GPT-5.6 metin modeli.

OpenAIAPI Key oluştur >

GPT-5.6 Sol

Chat

Zorlu kodlama, muhakeme ve uzun soluklu ajan işleri için premium bir GPT-5.6 metin modeli.

OpenAIAPI Key oluştur >

Gemini 3.1 Pro

Chat
GoogleAPI Key oluştur >

Gemini 3 Pro

Chat
GoogleAPI Key oluştur >

Son yazılar

Geçersiz API Anahtarı: Düzeltmeden Önce 401 ve 403'ü Teşhis Edin

2026-07-31

OpenRouter 429 Hatası Nasıl Çözülür: Sağlayıcı Hatası mı, Hız Limiti mi?

2026-07-31

DeepSeek V4 Flash ve GLM-5.2 Karşılaştırması: 0731 Güncellemesi Test Edildi

2026-07-31

B2B Reklam İstihbaratı HTML'den Çıkarılır: Yeniden Tasarımlara Dayanan Parser Yazmak

2026-07-31
AIREITER

Sorularınız mı var? Bize ulaşın
[email protected]

LLM

Gemini 3.6 FlashGemini 3.1 ProKimi K3Gemini 3 ProGemini 2.5 Pro

AI Video

Kling 3.0 Motion ControlSora 2 ProKling 3.0 TurboSora 2Kling 3.0

AI Görsel

FLUX.2 ProGPT-Image 2Wan 2.7 Image ProGPT 4o ImageSeedream 5.0 Pro

Blog

Tümünü Görüntüle →

Şirket

Gizlilik PolitikasıHizmet Şartlarıİade Politikası

© 2026 AIReiter. Tüm hakları saklıdır.