Claude Haiku 5.5, istek 100.000 giriş token’ını aşana kadar düşük maliyetli ve basit bir model gibi görünüyor. Anthropic, bu sınırın altında 1 milyon giriş token’ı için 0,10 dolar, 1 milyon çıkış token’ı için 0,50 dolar ücret belirtiyor. Sınır aşıldığında ise aynı değerler sırasıyla 0,50 dolar ve 2,50 dolara çıkıyor. Üretim bütçesi hazırlarken asıl dikkate alınması gereken sayı, lansman söylemi değil; giriş maliyetindeki bu beş katlık artış.
Claude Haiku 5.5 API fiyatları kısaca
Doğrudan API fiyatlandırması, istekleri giriş prompt’unun boyutuna göre ayırıyor ve ücretleri token başına değil, 1 milyon token başına ABD doları cinsinden veriyor. Aşağıdaki tablo Anthropic’in Claude platformu fiyatlandırmasını ve Haiku 5.5 lansman duyurusunu temel alıyor; pazar yeri fiyatları farklı olabilir.
Fiyatlandırmada asıl karar noktası 100 bin token sınırı
Bu eşik, isteğin giriş prompt’uyla ilgili. Modelin geniş bir bağlam penceresine sahip olması nedeniyle uygulanan genel bir ek ücret değil. 90.000 giriş token’ı ve 2.000 çıkış token’ı içeren bir istek düşük katmanda kalırken, 120.000 giriş token’ı içeren bir istek uzun prompt katmanında belirtilen daha yüksek giriş ve çıkış ücretlerine tabi oluyor.
10.000 giriş token’ı ve 500 çıkış token’ı içeren basit bir isteğin düşük katmandaki hesabı şöyle:
(10,000 x $0.10 + 500 x $0.50) / 1,000,000 = $0.00035
Aynı istekten 10.000 kez gönderildiğinde, araç, platform veya yeniden deneme maliyetleri hariç toplam 3,50 dolar tutar. Katman farkını geçerli bir uzun prompt üzerinden görmek için 120.000 giriş token’ı ve 500 çıkış token’ı içeren bir isteğin maliyeti şöyle hesaplanır:
(120,000 x $0.50 + 500 x $2.50) / 1,000,000 = $0.06125
Bu da aynı türden 10.000 istek için 612,50 dolar demek. Hesaplama yaparken yalnızca kullanıcının gördüğü soruyu değil, API’ye gönderilen toplam girdi miktarını dikkate alın.
Anthropic’in resmi Reddit duyurusuna göre 100 bin token’a kadar olan istekler Haiku 4.5’e kıyasla yaklaşık %90, 100 bin token’ın üzerindeki istekler ise yaklaşık %50 daha ucuz. Ancak bunları her iş yükünde geçerli kesin tasarruf oranları olarak değil, lansman dönemine ait karşılaştırmalı iddialar olarak değerlendirin. Yeniden denemeler, çıktı uzunluğu, tokenizer davranışı ve önbellek isabet etmeyen istekler faturayı değiştirebilir.
Önbellekleme ve Batch gerçek maliyeti değiştiriyor
Bir uygulama aynı talimatları veya bilgi paketini tekrar tekrar gönderiyorsa prompt önbellekleme özellikle işe yarar. Haiku 5.5’te beş dakikalık önbelleğe yazma ücreti standart giriş fiyatının 1,25 katı; önbellekten okuma ise standart giriş fiyatının onda biri. Yüksek prompt katmanında da aynı oranlar geçerli.
| İşlem | 100 bine kadar | 100 binin üzeri |
|---|---|---|
| Beş dakikalık önbelleğe yazılan ilk 1 milyon token | $0.125 | $0.625 |
| Önbellekten okunan her 1 milyon token | $0.01 | $0.05 |
| Batch içindeki her 1 milyon giriş token’ı | $0.05 | $0.25 |
| Batch içindeki her 1 milyon çıkış token’ı | $0.25 | $1.25 |
Beş dakikalık önbellek, yazma primini hızlıca telafi ettiği için genellikle yaklaşık iki okumadan sonra başa baş noktaya gelir. Örneğin 1 milyon token’lık bir ön ekin önbelleğe yazılması 0,125 dolar, okunması ise 0,01 dolar tutar. Önbellek kullanılmadan yapılan iki okumanın maliyeti ise çıktı hariç 0,20 dolardır. Bir saatlik önbellek, temel giriş ücretinin iki katına fiyatlandırılır; dolayısıyla maliyetini karşılamak için daha fazla tekrarlı okuma gerekir. Kesin sonuç, önbellek anahtarının değişmeden kalıp kalmadığına ve isteğin aynı fiyatlandırma katmanında olup olmadığına bağlıdır.
Batch API; gece yapılan zenginleştirme işlemleri, toplu sınıflandırma, geriye dönük veri işleme ve değerlendirme çalışmaları gibi eşzamansız görevlerde giriş ve çıkış ücretlerini yarıya indirir. Ancak bu, eşzamanlı sohbetin alternatifi değildir; karşılığında gecikme artar. Rotanız her iki yöntemi de destekliyorsa Batch ile önbellekleme birlikte kullanılabilir. Yine de her isteğin önbellekten okunduğunu varsaymak yerine nihai usage alanlarını kontrol edin.
İzlemeniz gereken operasyonel sinyal, Anthropic’in Messages API kullanım şemasında belgelenen cache_read_input_tokens alanıdır. İlk isteğin ardından bu değer sıfırda kalıyorsa prompt sıralamasını, zaman damgalarını, araç serileştirmesini ve cache-control yerleşimini inceleyin. Sürekli soğuk kalan bir önbelleğe sahip ucuz model, nominal ücreti daha yüksek olsa bile doğru şekilde önbelleğe alınan bir rotadan daha pahalıya mal olabilir.
Haiku 5.5, eski Haiku modelleri ve Sonnet karşısında
Aşağıdaki karşılaştırmada Haiku 5.5 öncesinde yayımlanan doğrudan fiyatlar kullanılıyor. Haiku 4.5, bir referans noktası olarak dahil edildi; her sağlayıcının aynı fiyatları uyguladığı iddia edilmiyor.
| Model | Giriş / MTok | Çıkış / MTok | Bütçe açısından en uygun kullanım |
|---|---|---|---|
| Claude Haiku 5.5, <=100K | $0.10 | $0.50 | Yüksek hacimli, kısa çıktılı işler |
| Claude Haiku 5.5, >100K | $0.50 | $2.50 | Kalitenin üst katmanı haklı çıkardığı uzun prompt’lar |
| Claude Haiku 4.5 | $1.00 | $5.00 | Bilinen bir referans noktası gerektiren mevcut entegrasyonlar |
| Claude Sonnet 5.5 | $2.00 | $10.00 | Daha zorlu üretim görevleri |
Başlık üretimi, sınıflandırma, bilgi çıkarma, yönlendirme, kısa özetler ve yüksek hacimli diğer arka plan görevlerinde ilk denenmesi gereken model Haiku 5.5. Reddit’te bir kullanıcı, Haiku tarzı modelleri “yüksek hacimli, düşük karmaşıklıklı görevler” için uygun bulduğunu; konuşma başlığı oluşturma veya metinden yazılım adlarını çıkarma gibi işlerde kullandığını belirtti (u/jam_pod_). Bu yaklaşım, Haiku’yu her ajan adımında daha güçlü bir modelin otomatik alternatifi olarak görmekten daha doğru.
Seçimi yalnızca token fiyatına göre yapmayın. Haiku isteklerinizin yarısında ikinci bir denemeye ihtiyaç duyarken Sonnet ilk seferde kabul edilebilir sonuçlar üretiyorsa, kağıt üzerindeki iki katlık fiyat farkı hızla ortadan kalkabilir. Üretim trafiğini yönlendirmeden önce temsili bir örneklemde faturalandırılan girişi, faturalandırılan çıkışı, yeniden denemeleri ve kabul edilen sonuçları ölçün.
Üretim maliyeti için pratik kural
Haiku 5.5’i kullanmaya karar vermeden önce şu adımları izleyin:
- Gerçek prompt’unuzu araçları, getirilen belgeleri ve konuşma geçmişini de dahil ederek Anthropic’in token sayımı dokümantasyonunda çalıştırın.
- Trafiği
<=100Kve>100Kgiriş istekleri olarak ayırın; iki katmanı tek bir ortalamada birleştirmeyin. - Çıkışı ayrıca tahmin edin. Kısa bir girdiyle uzun bir yanıt üretiliyorsa maliyeti ağırlıklı olarak çıkış belirler.
- Sabit ön ekleri cache control arkasına alın ve önbellek okumaları sıfıra düştüğünde uyarı üretin.
- Bekleyebilecek işleri Batch API üzerinden gönderin; etkileşimli istekler için eşzamanlı yönlendirmeyi koruyun.
- Haiku 5.5 ile Sonnet 5.5’i 1 milyon token başına maliyetle değil, kabul edilen sonuç başına maliyetle karşılaştırın.
Bu yöntem, lansman günündeki verilerdeki temel belirsizliği de yönetir: Resmi fiyatlandırma ve erişilebilirlik net olsa da bağımsız gecikme, hata oranı ve uzun bağlam kalitesi ölçümleri henüz yeterince ortaya konmuş değil. Reddit tartışmasında da aynı soru açık biçimde soruluyor: “100 bine kadar prompt” ne anlama geliyor? (u/ShadowBannedAugustus). Üretim ekibi için bu sorunun cevabı tahminle değil, faturalandırma testiyle bulunmalı.
Claude Haiku 5.5 API hakkında sık sorulanlar
Claude Haiku 5.5 API model ID’si nedir?
Anthropic’in Claude Code sürüm notlarında belirtildiği üzere mevcut takma ad olarak claude-haiku-5-5 kullanın. Tekrarlanabilir yönlendirme önemliyse snapshot ID’sini API model dokümantasyonundan doğrulayın.
100 bin token’lık bir Haiku 5.5 isteği ne kadar tutar?
100.000 giriş token’ı ve hiç çıkış olmaması durumunda düşük katmandaki giriş ücreti 0,01 dolardır. Aynı katmanda çıkış ayrıca, 1 milyon token başına 0,50 dolar üzerinden ücretlendirilir. Daha yüksek katman, prompt belgelenen sınırı aştığında uygulanır.
Haiku 5.5, Claude Pro veya Max aboneliğine dahil mi?
Anthropic’in Claude platformu fiyatlandırmasında gösterildiği üzere Claude aboneliği ile Claude API kullanımı ayrı faturalandırma ürünleridir. Programatik trafik için API fiyatlandırma tablosunu kullanın.
Batch fiyatlandırması prompt önbelleklemesiyle birlikte kullanılabilir mi?
Anthropic’in fiyatlandırma dokümantasyonu, Batch’i uygun token ücretlerinde %50 indirim olarak sunuyor; önbelleğe alınan token’ların hesaplanması ise ayrı kalıyor. Önbellek uygunluğu ve sağlayıcıya özgü destek farklılık gösterebileceğinden rotanızın nihai usage alanlarını kontrol edin.
Haiku 5.5 her istekte Haiku 4.5’ten daha ucuz mu?
Yayımlanan doğrudan fiyatlara göre Haiku 5.5, her iki giriş katmanında da daha ucuz. Ancak yeniden denemeler, daha uzun çıktılar, önbellek isabetsizlikleri veya işi başarıyla tamamlamak için daha güçlü bir modele ihtiyaç duyan iş yükleri gerçek tasarrufu azaltabilir.