Hesabınızı yalnızca 1 milyon giriş token'ı için 10 dolar, 1 milyon çıktı token'ı için 50 dolar başlık fiyatlarına göre yapmayın. 272.000 giriş token'ını aşan isteklerde, isteğin tamamı için daha yüksek tarife uygulanıyor. Üstelik GPT-6 Astra erişimi hâlâ kademeli olarak açılıyor; dokümantasyonda modelin yer alması, hesabınızın modeli çağırabileceği anlamına gelmiyor.
GPT-6 Astra API fiyatları: Kısa özet
Aşağıdaki fiyat tablosu OpenAI’ın resmi model sayfasından alınmıştır. Önbelleğe alınmış istemler, uzun bağlamlı istekler ve Fast modu gerçek maliyeti ciddi biçimde değiştirebilir.
| Kalem | Güncel bilgi |
|---|---|
| API model kimliği | gpt-6-astra |
| Standart giriş | 1 milyon token için 10,00 dolar |
| Önbelleğe alınmış giriş | 1 milyon token için 1,00 dolar |
| Önbellek yazma | 1 milyon token için 12,50 dolar |
| Standart çıktı | 1 milyon token için 50,00 dolar |
| Bağlam penceresi | 1.050.000 token |
| Maksimum çıktı | 128.000 token |
| Bilgi kesim tarihi | 30 Nisan 2026 |
| Giriş/çıkış | Metin ve görsel girişi; metin çıktısı |
| Ücretsiz API katmanı | Desteklenmiyor |
| Güncel erişilebilirlik | Trusted Access kapsamındaki kurumsal müşterilere kademeli olarak açılıyor; daha geniş API ve ücretli plan erişiminin önümüzdeki günlerde sunulması planlanıyor |
Bu rakamlar bir ön sürüm tahmini değil, GPT-6 Astra model sayfasındaki resmi fiyatlar. OpenAI’ın model rehberine göre araç çağırma özelliği için Responses API kullanılması gerekiyor.
Faturayı değiştiren üç temel fiyat kuralı
GPT-6 Astra’da dört ayrı token kategorisi ve bunlara ek olarak servis modu kuralları bulunuyor. Modeli yalnızca 10 dolar giriş / 50 dolar çıkış şeklinde değerlendirmek, önbellek oluşturma, uzun istemler ve düşük gecikmeli işlem maliyetlerini olduğundan düşük gösterir.
Standart giriş, önbellek okuma ve önbellek yazma
Standart girişin ücreti 1 milyon token için 10 dolar, önbelleğe alınmış girişin ücreti 1 dolar, önbellek yazmanın ücreti ise 12,50 dolar. Başlangıçtaki yazma işleminden sonra aynı içeriği yeniden kullanmak oldukça ucuz olabilir.
| Token kategorisi | Standart ücret | Ne ifade ediyor? |
|---|---|---|
| Önbelleğe alınmamış giriş | 1 milyon için 10,00 dolar | Modelin ilk kez işlediği yeni giriş |
| Önbelleğe alınmış giriş | 1 milyon için 1,00 dolar | Daha önce işlenmiş ve önbellekten sunulan giriş |
| Önbellek yazma | 1 milyon için 12,50 dolar | İstem önbelleğine eklenen giriş |
| Çıktı | 1 milyon için 50,00 dolar | Modelin ürettiği yanıt token'ları |
Bağlam penceresini giriş fiyatıyla çarpmayın. 1,05 milyon token'lık bağlam penceresi bir kapasite sınırıdır; tüm token'ların temel tarifeden ücretlendirileceği anlamına gelmez.
272K eşiği tüm istek için geçerli
Bir istek 272.000’den fazla giriş token'ı içerdiğinde OpenAI, isteğin tamamı için giriş ve önbellek ücretlerini 2 katına, çıkış ücretlerini ise 1,5 katına çıkarıyor. Böylece uzun bağlam tarifesi; önbelleğe alınmamış giriş için 1 milyon token başına 20 dolar, önbelleğe alınmış giriş için 2 dolar, önbellek yazma için 25 dolar ve çıktı için 75 dolar oluyor.
| İstek türü | Giriş | Önbelleğe alınmış giriş | Önbellek yazma | Çıktı |
|---|---|---|---|---|
| 272K giriş veya daha az | 10 dolar | 1 dolar | 12,50 dolar | 50 dolar |
| 272K girişin üzerinde | 20 dolar | 2 dolar | 25 dolar | 75 dolar |
Örneğin 300K giriş token'ı içeren bir istekte, geçerli tüm giriş, önbellek ve çıktı token'ları yüksek uzun-bağlam tarifesinden hesaplanır. İlk 272K token standart tarifeden ücretlendirilmez.
Batch, Flex, Fast ve bölgesel dağıtım seçenekleri
OpenAI, Batch ve Flex modlarını geçerli ücretlerin yüzde 50’si üzerinden fiyatlandırıyor. Model rehberine göre Fast modu geçerli ücretlerin 2 katına mal oluyor, herhangi bir gecikme SLA’i sunmuyor ve AB veri yerleşimiyle kullanılamıyor. Priority işleme de AB veri yerleşimiyle birlikte kullanılamıyor.
| Mod | Standart giriş | Standart çıktı | Pratik karşılığı |
|---|---|---|---|
| Standard | 1 milyon için 10 dolar | 1 milyon için 50 dolar | Varsayılan doğrudan API seçeneği |
| Batch veya Flex | 1 milyon için 5 dolar | 1 milyon için 25 dolar | Geçerli Standard ücretinin yarısı |
| Fast | 1 milyon için 20 dolar | 1 milyon için 100 dolar | Geçerli Standard ücretinin iki katı |
| Uzun bağlam Standard | 1 milyon için 20 dolar | 1 milyon için 75 dolar | 272K girişin üzerindeki isteklerde geçerli |
| Uzun bağlam Fast | 1 milyon için 40 dolar | 1 milyon için 150 dolar | Uzun bağlam ücretlerinin 2 katı |
Tablo yalnızca önbelleğe alınmamış giriş ve çıktı ücretlerini gösteriyor. Önbellek okuma ve yazma ücretleri de ilgili servis modu çarpanına göre değişiyor.
Microsoft Foundry’nin ayrıca yayımlanmış bir dağıtım tablosu var. GPT-6 Astra duyurusunda Global Standard kısa bağlam ücretleri 10 dolar giriş, 1 dolar önbelleğe alınmış giriş, 12,50 dolar önbellek yazma ve 50 dolar çıktı olarak listeleniyor. U.S. Data Zone Standard ücretleri ise 11, 1,10, 13,75 ve 55 dolar. Uzun bağlam tablosunda Global için 20/2/25/75 dolar, U.S. Data Zone içinse 22/2,20/27,50/82,50 dolar değerleri yer alıyor. Doğrudan OpenAI fiyatlarını Azure bütçesine olduğu gibi aktarmayın.
Gerçek bir Astra isteğinin maliyeti
Aşağıdaki örneklerde doğrudan OpenAI Standard fiyatları kullanılıyor. Araçlar ve yeniden denemeler hesaba katılmıyor; token'lar da belirtildiği şekilde önbelleğe alınmış veya alınmamış kabul ediliyor.
| Örnek istek | Hesaplama | Tahmini token ücreti |
|---|---|---|
| 100K önbelleğe alınmamış giriş + 10K çıktı | 0.1 × $10 + 0.01 × $50 | 1,50 dolar |
| 200K önbelleğe alınmış giriş + 20K çıktı | 0.2 × $1 + 0.02 × $50 | 1,20 dolar |
| 300K önbelleğe alınmamış giriş + 30K çıktı | 0.3 × $20 + 0.03 × $75 | 8,25 dolar |
Uzun bağlamlı iş akışlarını devreye almadan önce 272K sınırını mutlaka test edin. Bilgi getirme veya bağlamı daraltma model maliyetini düşürebilir, ancak uygulama tarafında ek iş çıkarır.
200K token'ı önbelleğe yazmak 2,50 dolara mal olurken, daha sonra gerçekleşen 200K token'lık bir önbellek isabeti 0,20 dolar tutar. Önbelleklemenin ne zaman avantajlı hâle geleceği, içeriğin ne sıklıkta yeniden kullanıldığına bağlıdır.
Microsoft Foundry’de Global kısa bağlam tablosuna göre 100K giriş ve 10K çıktı içeren bir istek, araçlar ve yeniden denemeler hariç, yine 1,50 dolar tutar. U.S. Data Zone sürümünde ücret 1,65 dolar olur: 0.1 × $11 + 0.01 × $55.
OpenAI’ın rehberine göre Astra, önceki modellere kıyasla tamamlanan görev başına daha düşük tahmini maliyet sunabilir. Ancak bu ifade bağımsız bir üretim maliyeti karşılaştırması değil. Kendi iz kayıtlarınızda giriş token'larını, önbellek isabetlerini, çıktı token'larını, araç çağrılarını, yeniden denemeleri ve insan düzeltmelerini ölçün.
Erişim, kotalar ve ChatGPT/API ayrımı
GPT-6 Astra, Trusted Access Program kapsamındaki kurumsal müşterilere kademeli olarak açılıyor. API erişiminin yanı sıra Plus, Pro, Business ve Enterprise erişiminin de önümüzdeki günlerde sunulması bekleniyor. OpenClaw OpenAI sağlayıcı dokümantasyonu da bir hesabın Astra erişimine sahip olup olmadığını hesap kataloğu keşfinin belirlediğini söylüyor; yapılandırmaya model adını eklemek tek başına erişim sağlamıyor.
Bir kullanıcı kullanıma sunma gecikmesini şöyle anlattı:
“Saat neredeyse sabah 2 ve sinirden yatmaya gidiyorum. Astra’yı BÜTÜN GÜN bekledim. ... Sonra öğrendim ki: KULLANAMIYORUM.” — @buildwithrajath, X
Model sayfasında kullanım katmanlarına göre API limitleri şöyle listeleniyor:
| Katman | RPM | TPM | Batch kuyruğu limiti |
|---|---|---|---|
| Free | Desteklenmiyor | Desteklenmiyor | Desteklenmiyor |
| Katman 1 | 500 | 500.000 | 1.500.000 |
| Katman 2 | 5.000 | 1.000.000 | 3.000.000 |
| Katman 3 | 5.000 | 2.000.000 | 100.000.000 |
| Katman 4 | 10.000 | 4.000.000 | 200.000.000 |
| Katman 5 | 15.000 | 40.000.000 | 15.000.000.000 |
Astra fiyatlandırması yalnızca API için geçerli. Alıntılanan dokümantasyona göre ChatGPT planlarına API kredileri dahil değil; bu nedenle Platform API kullanımını bütçenizde ayrı değerlendirin.
Mevcut ajanlar için geçiş kontrolleri
OpenAI’ın model rehberi geçiş öncesinde üç noktayı kontrol etmenizi öneriyor:
- Model ve API:
modeldeğerinigpt-6-astraolarak ayarlayın, hesap kataloğunda modelin göründüğünü doğrulayın ve araç çağırma için Responses API’yi kullanın. - İstek parametreleri:
low,medium,high,xhighveyamaxseçeneklerinden birini belirleyin; Astranoneseçeneğini desteklemiyor. Desteklenmeyen örnekleme ve log-probability parametrelerini kaldırın. - Önbellek ve bölge: OpenAI’ın eski modellere yönelik geçiş rehberini izliyorsanız
prompt_cache_retentionyerineprompt_cache_options.ttl: "30m"kullanın. Ardından AB veri yerleşimi için Fast ve Priority ayarlarını yeniden kontrol edin.
Bütçe kararı: token fiyatına değil, iz kayıtlarına göre yönlendirin
GPT-6 Astra; uzun süren, yoğun araç kullanımı gerektiren, hata maliyeti yüksek olan veya temiz bir API sunmayan yazılımlar tarafından engellenen görevlerde daha kolay gerekçelendirilebilir. Buna karşılık 1 milyon çıktı token'ı için 50 dolar ödemek daha az yeniden deneme ya da daha iyi tamamlanmış iş sağlamıyorsa, kısa ve rutin istemler için iyi bir varsayılan model değildir.
- Önce Astra’yı test edin: Uzun bağlamlı araştırma, bilgisayar kullanımı, karmaşık kodlama ve birden fazla uygulamayla çalışan iş akışlarında deneyin. Bu senaryolarda hata, inceleme veya yeniden işleme maliyeti doğurabilir.
- Daha ucuz bir modeli varsayılan olarak tutun: Kısa sınıflandırma, veri çıkarma, basit taslak oluşturma ve öngörülebilir dönüşümler için.
- Batch veya Flex kullanın: Gecikmenin kritik olmadığı ve iş yükünün yüzde 50 ücret tarifesiyle uyumlu olduğu durumlarda.
- Fast modunu varsayılan yapmayın. Uzun bağlam çarpanı uygulanmadan önce bile 1 milyon token başına 20 dolar giriş ve 100 dolar çıkış ücreti alan bu mod, ölçülebilir bir işlem hacmi avantajı sağlamalı.
- 272K için kesin bir sınır koyun. İstek bu eşiği geçmeden önce uyarı üretin; çünkü yüksek tarife isteğin tamamına uygulanıyor.
Kararı yalnızca token fiyatına bakarak değil, kendi iz kayıtlarınızdan elde ettiğiniz kabul edilen görev başına maliyete göre verin. Bütçe karşılaştırması yaparken GPT-5.6 fiyatlandırma rehberindeki ve OpenRouter fiyatlandırma rehberindeki varsayımları inceleyebilirsiniz; ancak bu rehberlerdeki tarife kurallarını Astra’ya doğrudan aktarmayın.
GPT-6 Astra API fiyatlandırması: SSS
GPT-6 Astra’nın 1 milyon token başına fiyatı ne kadar?
Standart fiyatlandırma; 1 milyon önbelleğe alınmamış giriş token'ı için 10 dolar, 1 milyon önbelleğe alınmış giriş token'ı için 1 dolar, 1 milyon önbellek yazma token'ı için 12,50 dolar ve 1 milyon çıktı token'ı için 50 dolar.
272K giriş token'ı aşılırsa ne olur?
Giriş ve önbellek ücretleri iki katına çıkar, çıktı ücreti ise yüzde 50 artar. İsteğin tamamı için 1 milyon token başına ücretler 20 dolar giriş, 2 dolar önbelleğe alınmış giriş, 25 dolar önbellek yazma ve 75 dolar çıktı olur.
Önbelleğe alınmış giriş ile önbellek yazma aynı şey mi?
Hayır. Önbelleğe alınmış giriş, Standard katmanda 1 milyon token başına 1 dolar ücretlendirilen bir önbellek isabetidir. Önbellek yazma ise önbelleğe alınmış istem ön ekini oluşturur veya günceller ve 1 milyon token başına 12,50 dolar tutar.
Batch veya Flex, GPT-6 Astra fiyatını yarıya indiriyor mu?
OpenAI, Batch ve Flex modlarını geçerli Standard ücretlerinin yüzde 50’si olarak listeliyor. Uzun bağlam eşiği aşılırsa, geçerli uzun bağlam tarifesi de buna dahil.
Fast modu ek ücrete değer mi?
Fast modu geçerli ücretlerin 2 katına mal oluyor ve gecikme SLA’i sunmuyor. Bu nedenle yalnızca iz kayıtlarınız, işlem hacmindeki veya kullanıcı değerindeki artışın ek maliyeti karşılayacağını gösteriyorsa kullanın.
GPT-6 Astra’yı bugün API üzerinden kullanabilir miyim?
Erişim henüz herkese açık değil, kademeli olarak sunuluyor. OpenAI başlangıçta Trusted Access kapsamındaki kurumsal erişimi listeliyor ve daha geniş API erişiminin önümüzdeki günlerde geleceğini belirtiyor. Bu nedenle son kontrol noktası hesabınızın kataloğu.
ChatGPT Plus, GPT-6 Astra API kredilerini içeriyor mu?
Model dokümantasyonu, ChatGPT planıyla birlikte API kredisi verileceğini taahhüt etmiyor. Hesabınızın açık faturalandırma koşulları aksini söyleyene kadar ücretli plan kapsamındaki model erişimini ve kullanım bazlı Platform API faturalandırmasını ayrı değerlendirin.
GPT-6 Astra için hangi API değişiklikleri gerekiyor?
model değerini gpt-6-astra olarak ayarlayın, araç çağırma için Responses API’yi kullanın, desteklenen bir reasoning effort seçin, desteklenmeyen örnekleme ve log-probability parametrelerini kaldırın, önbellek TTL’ini ve bölgesel Fast modu kurallarını gözden geçirin. Astra’yı varsayılan model yapmadan önce temsili bir çalışmada token'ları, önbellek davranışını, araçları, yeniden denemeleri ve insan düzeltmelerini kaydedin.