29 Temmuz 2026'da Claude Opus 5, GPT-5.6 Sol, Terra ve Luna'nın önüne aynı dört görevi koyduk. Toplam 16 yanıt aldık ve 16'sı da doğruydu. Bu küçük kapsamlı dört kontrolde doğruluk, modeller arasında tercih yapmaya yetmiyor.
Asıl ayrım, para ödediğiniz iki noktada ortaya çıktı: Opus 5, Sol'ün 480 çıkış token'ına karşılık 1.642 token faturalandırdı. Ayrıca 272.000 giriş token'ının üzerindeki isteklerde GPT-5.6 daha yüksek fiyat tarifesine geçerken Claude Opus 5, 1M'lik bağlam penceresinin tamamını sabit fiyatla ücretlendiriyor. 200K giriş ve 20K çıkıştan oluşan bir istekte iki amiral gemisi modelin liste fiyatı arasındaki fark %7'nin altında kalıyor. Çıkış hacmi büyüdükçe ve 272K sınırı aşıldıkça fark açılıyor; dolayısıyla karar, isteğin yapısına ve model davranışına bağlı.
Dört modeli aynı görevlerle karşılaştırdık
Her modele, mekanik olarak doğrulanabilen sonuçları olan dört kontrol için birebir aynı kullanıcı istemini verdik: hatalı bir Python median fonksiyonunu düzeltmek, sabit bir metindeki harf tekrarlarını saymak, saatin 3:15'te gösterdiği 7,5 derecelik açıyı hesaplamak ve davranışı değiştirmeden kasıtlı olarak dağınık yazılmış bir JavaScript fonksiyonunu düzenlemek. Kod yanıtlarını gözle değerlendirmek yerine uç durumlarda çalıştırarak doğruladık.
Tüm modeller her kontrolden geçti. Python düzeltmelerinin hepsi çift sayıda eleman içeren listeleri doğru işledi; dört modelin tamamı doğru sonuçlar olan 9 ve 7,5 değerlerini verdi. Ayrıca tüm yeniden düzenlemeler, falsy alanları ve null kategori filtrelerini içeren davranış farkı testini geçti.
Bu rakamları yorumlamadan önce üç uyarı gerekiyor. Her model ve görev için yalnızca tek çalıştırma yaptık; bu bir benchmark değil, hızlı bir kontrol. Çağrılar, kendi sistem istemini ekleyen bir ağ geçidi üzerinden yapıldı. Bu nedenle giriş token'ları istekler arasında 35 ile 4.415 arasında değişti ve bunları değerlendirmeden tamamen çıkardık. Ayrıca iki sağlayıcı da gizli akıl yürütme token'larını çıkış olarak ücretlendiriyor; yani burada “çıkış token'ı”, okuduğunuz metni değil faturalanan miktarı ifade ediyor.
Beraberliğe rağmen niteliksel açıdan bir fark öne çıktı: Dört model içinde en iyi yeniden düzenlemeyi Opus 5 yaptı. Orijinaldeki iki döngüyü tek geçişte birleştirdi, 1,2 çarpanını isimlendirilmiş bir sabite taşıdı ve davranışı korumak için gevşek eşitliği bilinçli olarak koruduğunu açıklayan bir yorum ekledi. Sol, Terra ve Luna'nın sonuçları doğruydu, ancak daha birebir iki döngülü dönüşümler sundular.
Fark doğrulukta değil, token ve sürede
16 çalıştırmanın tamamında doğruluk aynı olduğundan, pratik karşılaştırma her yanıtın maliyeti üzerinden yapılıyor. Opus 5 dört görevi toplam 32,4 saniyede tamamladı ve 1.642 tamamlama token'ı faturalandırdı. Sol 19,7 saniye ve 480 token, Terra 11,7 saniye ve 308 token, Luna ise 15,3 saniye ve 537 token kullandı.
| Tek çalıştırma, 29 Temmuz 2026 | Doğru | Çıkış token'ı | Toplam süre | Yalnızca çıkış maliyeti |
|---|---|---|---|---|
| Claude Opus 5 | 4/4 | 1.642 | 32,4 sn. | $0.0411 |
| GPT-5.6 Sol | 4/4 | 480 | 19,7 sn. | $0.0144 |
| GPT-5.6 Terra | 4/4 | 308 | 11,7 sn. | $0.0046 |
| GPT-5.6 Luna | 4/4 | 537 | 15,3 sn. | $0.0032 |
Aradaki fark yanıt uzunluğundan değil, akıl yürütme hacminden kaynaklanıyor. Opus 5'in yeniden düzenleme yanıtı 492 baytlık nihai metne karşılık 1.308 token faturalandırdı; Sol'ün 7 token harcadığı “7,5” yanıtı için ise 64 token kullandı. Anthropic dokümanları, API'de Opus 5'in varsayılan olarak yüksek eforla çalıştığını belirtiyor. Dolayısıyla bunun bir bölümü sabit bir model özelliği değil, varsayılan ayar; bizim ölçtüğümüz alt sınır değil, varsayılan davranıştı.
Topluluk verileri de bu tabloyu destekliyor. 29 Temmuz'da bu sorgu için Google'daki ilk sonuç olan r/Anthropic'teki grafik paylaşımı, kodlama puanlarında ikisini neredeyse başa baş gösterirken Opus'un daha uzun sürdüğünü ve belirgin biçimde daha fazla token tükettiğini ortaya koyuyor. Bir r/ClaudeCode kullanıcısı aynı sonucu daha az nazik bir dille şöyle özetliyor:
GPT 5.6 Sol, doğrudan istediğiniz işe başlıyor. Opus 5 ise 12 ciltlik “Savaş ve Barış” yazıyor, ardından istediğiniz işe başlıyor.
Bununla birlikte efor ayarları ekonomik dengeyi tersine çevirebilir. Artificial Analysis verilerini inceleyen bir Hacker News yorumcusu, yüksek efordaki Opus 5'in intelligence-index çalıştırması başına yaklaşık $1,06'ya, maksimum ayardaki Sol'ün ise $1,04'e geldiğini belirtti. İki model de yoğun akıl yürüttüğünde maliyetler neredeyse eşitleniyor.
GPT-5.6 tek bir model değil: Sol, Terra ve Luna
GPT-5.6 adı tek bir modeli ifade etmiyor. OpenAI üç ayrı SKU sunuyor ve yalın gpt-5.6 ifadesi, en pahalı seçenek olan gpt-5.6-sol için takma ad olarak belgelenmiş. Yapılandırmanızda gpt-5.6 kullanıyorsanız, ailenin en yüksek tarifesinden ücretlendirilirsiniz. Maliyet kıyaslamasına başlamadan önce bunu kontrol etmekte fayda var.
OpenAI model referansında Sol, “karmaşık profesyonel işler için frontier model”; Terra, “zeka ve maliyeti dengeleyen” katman; Luna ise “maliyet hassasiyetli iş yükleri için optimize edilmiş” seçenek olarak tanımlanıyor. Üçü de 1,05M token bağlam penceresini, 128K maksimum çıkışı, 16 Şubat 2026 bilgi kesim tarihini ve none ile max arasında seçilebilen altı akıl yürütme efor seviyesini paylaşıyor.
| Özellik, 29 Temmuz 2026'da doğrulandı | Claude Opus 5 | GPT-5.6 (üçü de) |
|---|---|---|
| Bağlam penceresi | 1M token | 1,05M token |
| Maksimum çıkış | 128K (Batch API beta ile 300K) | 128K |
| Güvenilir bilgi kesim tarihi | Mayıs 2026 | 16 Şubat 2026 |
| Akıl yürütme kontrolü | Uyarlanabilir düşünme, effort varsayılanı high | none / low / medium / high / xhigh / max |
| API kimliği | claude-opus-5 | gpt-5.6-sol / -terra / -luna |
Bu satırlardan ikisi karar aşamasında gerçekten önem taşıyor. Opus 5'in Mayıs 2026 bilgi kesim tarihi, tüm GPT-5.6 ailesinden üç ay daha güncel; bu da 2026 ilkbaharındaki sürümlere atıfta bulunan işlerde fark yaratabilir. Akıl yürütme kontrolleri de yalnızca sayı bakımından değil, yapı olarak farklı: GPT-5.6'da none ile akıl yürütmeyi tamamen kapatabiliyorsunuz. Opus 5 ise düşünme bütçesini uyarlanabilir biçimde yönetiyor ve bunun üzerinde efor seviyeleri sunuyor.
Fiyatlandırmada kritik eşik: 272K giriş token'ı
İki sağlayıcı da net token başı fiyatlar yayımlıyor ve 272K giriş token'ının altında rakamlar birbirine yakın. İki amiral gemisi model de milyon giriş token'ı başına $5 alıyor; Opus 5'te milyon çıkış token'ı $25, Sol'de $30. Önbelleğe alınmış giriş fiyatı ikisinde de $0,50 ve her iki tarafta da batch işlemler için %50 indirim var. Bu tarifelerle 200K giriş ve 20K çıkışlık bir istek, Opus 5'te $1,50, Sol'de $1,60 tutuyor.
| 1M token başına, 29 Temmuz 2026 liste fiyatı | Giriş | Önbelleğe alınmış giriş | Çıkış | Batch |
|---|---|---|---|---|
| Claude Opus 5 | $5.00 | $0.50 | $25.00 | $2.50 / $12.50 |
| GPT-5.6 Sol | $5.00 | $0.50 | $30.00 | $2.50 / $15.00 |
| GPT-5.6 Terra | $2.50 | $0.25 | $15.00 | $1.25 / $7.50 |
| GPT-5.6 Luna | $1.00 | $0.10 | $6.00 | $0.50 / $3.00 |
Yapısal fark 272K giriş token'ında başlıyor. OpenAI'nin fiyatlandırma sayfası, tüm GPT-5.6 fiyatlarını kısa bağlam ve uzun bağlam olarak ikiye ayırıyor: 272K girişin üzerindeyken giriş fiyatı 2 katına, çıkış fiyatı ise 1,5 katına çıkıyor. Bu da Sol'ü sırasıyla $10 ve $45'e taşıyor. Anthropic'in fiyatlandırma dokümanlarında ise bunun tersini anlatan tek bir cümle var: “900k token'lık bir istek, token başına 9k token'lık bir istekle aynı oranda ücretlendirilir.”
20K çıkış varsayımıyla rakamlara bakarsak: 300K girişli bir istek Opus 5'te $2,00, Sol'de $3,90 tutuyor. 500K'da maliyet $3,00'a karşı $5,90; 900K'da ise $5,00'a karşı $9,90. Eşik aşıldığında Opus 5, aynı istek yapısında Sol'ün yaklaşık yarı fiyatına geliyor.
Grafikte, Anthropic lehine net bir sonucu bozan dikkat çekici bir ayrıntı var. 272K'nın üzerinde Terra'nın ikiye katlanan giriş fiyatı $5; yani Opus 5 ile aynı. Uzun bağlamdaki $22,50'lik çıkış fiyatı ise Opus 5'in $25'inin altında. 20K çıkışta Terra, 300K, 500K, 700K ve 900K girişli her istekte Opus 5'ten sabit beş sent daha ucuz. Bu beş sent giriş boyutuyla değil, çıkış hacmiyle ölçekleniyor: fark, milyon çıkış token'ı başına $2,50.
Bütçe planlaması için üç dipnot daha var. Anthropic, Opus 5 için araştırma önizlemesinde hızlı mod sunuyor; fiyatı $10 giriş ve $50 çıkış. OpenAI'nin priority katmanı ise yalnızca kısa bağlamda geçerli olmak üzere standart fiyatların 2 katı. ABD bölgesinde veri ikameti iki sağlayıcıda da yaklaşık %10 ek maliyet getiriyor. Ayrıca Anthropic'in kendi notuna göre Claude'un güncel tokenizer'ı, aynı metin için 4.7 öncesi modellere kıyasla yaklaşık %30 daha fazla token üretiyor. Bu nedenle oranları çarpmadan önce temsilî bir istemi iki tokenizer'dan da geçirmek en sağlıklı son kontrol olur.
İş yüküne göre hangi modeli çağırmalı?
Doğrulukta beraberlik olduğu için yönlendirme kararını isteğin yapısı ve çalışma tarzı belirliyor. r/ClaudeCode geliştiricileri, ayrıntılı çalıştığı ve tarayıcıyla güçlü olduğu için Sol'ü yüksek eforda inceleme ve QA ajanı olarak kullanıyor. r/codex tarafında ise pek çok kişi işlerin çoğunu orta seviye akıl yürütmeyle daha ucuz GPT katmanlarına yönlendiriyor ve en iyi maliyet-performansın burada olduğunu bildiriyor.
| İstek yapısı | Tercih | Neden |
|---|---|---|
| 272K girişin altında, çıkış ağırlıklı ajan döngüleri | Claude Opus 5 | $25'e karşı $30 çıkış fiyatı; testimizde en güçlü yeniden düzenleme muhakemesi |
| 272K'nın altında, gecikmeye duyarlı veya yüksek hacimli işler | GPT-5.6 Terra | Test ettiğimiz başarılı modeller arasında en hızlı ve en ucuz seçenek |
| 272K girişin üzerinde | Claude Opus 5 veya Terra | Sol'ün uzun bağlam fiyatları ikiye katlanıyor; Terra, Opus 5'in beş sent altında kalıyor |
| İnceleme, QA ve tarayıcı odaklı kontrol | GPT-5.6 Sol | İnceleme derinliğini ayarlamak için altı efor seviyesi; kendi QA setinizde doğrulayın |
| Geçici sınıflandırma ve veri çıkarma | GPT-5.6 Luna | $1/$6 fiyatıyla dört kontrolün tamamını geçti |
Sol'ün QA rolünü hak ettiği konusunda herkes hemfikir değil. Bir r/codex başlığı, Sol'ü GPT-5.5'e göre gerileme olarak nitelendirirken Opus 5'in plan başına daha fazla görevi tamamladığını söylüyor. Varsayılanları test etmek ucuz: dört model de AIReiter kataloğunda yer alıyor (Opus 5, Sol); böylece kendi görevlerinizi yan yana yeniden çalıştırabilirsiniz.
Bu karşılaştırmadan akılda tutulacak tek sayı 272.000 giriş token'ı. Bu eşiğin altında davranış, gecikme ve $5'lik çıkış fiyatı farkına göre seçim yapın. Eşiğin üzerinde Sol'e karşı fiyat argümanı Anthropic'in lehine dönüyor; Terra Opus 5'ten beş sent daha ucuz, Luna ise ikisinden de çok daha düşük maliyetli.
SSS
gpt-5.6, GPT-5.6 Sol ile aynı model mi?
Evet. OpenAI model referansı, yalın gpt-5.6 ifadesinin gpt-5.6-sol'e çözümlenen bir takma ad olduğunu belirtiyor. Bu nedenle Sol tarifesi uygulanır: 272K girişin altında milyon token başına $5 giriş ve $30 çıkış, üstünde ise $10 ve $45.
Claude Opus 5 uzun bağlamlı isteklerde daha fazla mı ücretlendiriyor?
Hayır. Anthropic, normal API'de 1M'lik bağlam penceresinin tamamını standart oranlarla ücretlendiriyor ve 900K token'lık bir isteğin token başına 9K token'lık bir istekle aynı maliyette olduğunu söylüyor. Yalnızca isteğe bağlı hızlı mod daha pahalı: $10 giriş ve $50 çıkış.
Claude Opus 5 mi, GPT-5.6 mı daha ucuz?
Modele göre değişir. 272K girişin altında Opus 5, milyon çıkış token'ı başına Sol'den $5 daha ucuz; bunun dışındaki fiyatlar aynı. Terra ve Luna ise ikisinden de çok daha ucuz. 272K'nın üzerinde Opus 5, istek başına Sol'ün yaklaşık yarısına mal oluyor; Terra da Opus 5'ten marjinal olarak daha ucuz kalıyor.
Kodlama için Claude Opus 5, GPT-5.6'dan daha mı iyi?
29 Temmuz'daki çalıştırmamızda her iki model de düzeltme, sayma ve yeniden düzenleme görevlerini doğru tamamladı. Bu sorguda 29 Temmuz'da Google sonuçlarında öne çıkan r/Anthropic grafik paylaşımı da kodlama puanlarında modelleri neredeyse başa baş gösteriyor. Opus 5 en iyi yeniden düzenleme muhakemesini sergiledi, ancak varsayılan ayarlarda Sol'ün 3,4 katı çıkış token'ı faturalandırdı. Bu yüzden kodlama tercihi, ekonomi ve ayrıntı seviyesi tercihine bağlı.
Opus 5 ve GPT-5.6'nın bilgi kesim tarihleri nedir?
Anthropic, Claude Opus 5 için güvenilir bilgi kesim tarihini Mayıs 2026 olarak veriyor. Üç GPT-5.6 modeli de yaklaşık üç ay daha eski olan 16 Şubat 2026 kesim tarihini paylaşıyor.