AIREITER
API DOKÜMANLARIFİYATLANDIRMA
ŞABLONLAR
  • AIReiter
  • Blog
  • Ücretsiz LLM API Kotaları Karşılaştırması: 11 Sağlayıcı (2026)

Ücretsiz LLM API Kotaları Karşılaştırması: 11 Sağlayıcı (2026)

Son Güncelleme: 2026-09-08 08:39:59

Ücretsiz LLM API karşılaştırması: hızlı bakış

Bu tablo 8 Eylül 2026 tarihinde kontrol edildi. Limitler modele, hesaba, bölgeye ve talebe göre değişebilir; son karar için sağlayıcının bağlantısı verilen belgelerini esas alın.

Kart, ticari kullanım ve OpenAI uyumluluğu etiketleri, ikincil bir kontrol olarak Free LLM API Hub karşılaştırmasından yararlanır.

SağlayıcıÜcretsiz erişim ve yayınlanan kotaKart/ödeme koşuluAPI yapısıKullanım şartı sinyaliTemel sınırlama
Google AI StudioGemini modellerine göre değişir: 5–30 RPM ve 15–1.000 RPD; Gemini 2.5 Flash örneği: 10 RPM / 250 RPDKart belirtilmiyor; hesap ve proje doğrulaması gerekebilirDoğrulanan karşılaştırmaya göre OpenAI uyumluTicari kullanım uygun olarak listeleniyor; güncel şartları doğrulayınGoogle, geçerli limitlerin AI Studio’dan kontrol edilmesi gerektiğini söylüyor
GroqÖrnek qwen/qwen3.6-27b: 30 RPM / 1.000 RPD / 8.000 TPM / 200.000 TPDFree Plan için ücretli yükseltme gerekmiyor; Developer katmanı ödeme yöntemi istiyorEvet, büyük ölçüdeTicari kullanım uygun olarak listeleniyor; Free Plan limitleri ücretli kapasiteden farklıLimitler organizasyon ve model düzeyinde uygulanıyor
OpenRouterÜcretsiz varyantlar: satın alınan kredi $10 altında ise 20 RPM / 50 RPD; en az $10 satın alındığında 1.000 RPDTemel ücretsiz rota için kart gerekmiyor; kredi daha yüksek kotanın kilidini açıyorEvet, OpenAI Chat API’ye normalize edilmişTicari kullanım uygun olarak listeleniyor; ücretsiz model seçenekleri değişebilirDaha yüksek günlük kota satın alma koşuluna bağlı
Cloudflare Workers AIHesap genelinde paylaşılan günde 10.000 Neuron; 00:00 UTC’de sıfırlanıyorTemel tahsis ücretsiz; seçili modeller ücretli faturalandırma gerektiriyorDoğrulanan karşılaştırmaya göre OpenAI uyumluTicari kullanım uygun olarak listeleniyor; model uygunluğu değişiyorNeuron, sabit token kotasını değil hesaplama maliyetini ölçüyor
Cerebras InferenceFree Trial: listelenen modeller için 5 RPM / 30K önbelleksiz TPM / 90K toplam TPM / 1M TPDDoğrulanmış ödeme yöntemi gerekiyorAtıf yapılan belgelerde belirlenmemişDeneme erişimi; krediler 30 gün sonra sona eriyor$5 deneme kredisi kalıcı değil
SambaNova CloudFree Tier: listelenen modeller için 20 RPM / 20 RPD / 200.000 TPDFree Tier’da ödeme yöntemi yok; kart bağlamak ücretli Developer Tier’ı etkinleştiriyorEvet, belgelenmiş farklılıklarlaTicari kullanım uygun olarak listeleniyor; model şartlarını kontrol edin20 RPD limiti oldukça kısıtlayıcı
CohereAyda 1.000 çağrı; Chat 20 RPM, Embed dakikada 2.000 girdi, Rerank 10 RPMDoğrulanan karşılaştırmada kart belirtilmiyor; kayıt sırasında doğrulayınDoğrulanan karşılaştırmaya göre OpenAI uyumluDoğrulanan karşılaştırmada yalnızca değerlendirme amaçlıÇağrılar tokenlarla aynı şey değil
Z.AIGLM-4.7-Flash ve GLM-4.5-Flash, gösterilen token kategorileri için $0 olarak listeleniyor; herkese açık RPM/TPM bilgisi belirtilmemişDoğrulanan karşılaştırmada kart belirtilmiyorDoğrulanan karşılaştırmaya göre OpenAI uyumluTicari kullanım uygun olarak listeleniyor; model şartlarını doğrulayınToken başına $0 fiyat, kapasite hakkında bilgi vermiyor
NVIDIA NIMPrototip geliştirme için Free Inference Endpoints; açılış sayfasında genel bir kota yokÖdeme koşulu endpoint’e göre değişiyor; model sayfasını kontrol edinAtıf yapılan belgelerde belirlenmemişAtıf yapılan sayfada prototip/değerlendirme sinyali varAçılış sayfasındaki ücretsiz etiketi, yayınlanmış bir kota anlamına gelmiyor
Hugging Face Inference ProvidersÜcretsiz kullanıcılar değişiklik gösterebilen şekilde aylık $0.10 kredi alıyor; RPM/TPM yayınlanmamışResmî fiyatlandırma belgelerinde kart koşulu belirtilmiyorDoğrulanan karşılaştırmaya göre OpenAI uyumluSağlayıcı ve model şartlarını kontrol edinBu bir istek kotası değil, küçük bir kredi
Mistral StudioStudio Free mode; dokümantasyon ana sayfasında herkese açık kota yokAna sayfada kart koşulu belirtilmiyorOpenAI tarzı endpoint belgelenmiş; tam uyumluluk iddia edilmiyorDeneme ve keşif/değerlendirme sinyali var; şartları doğrulayınFree mode, sınırsız veya üretime hazır erişimin kanıtı değil

Satırları yalnızca en büyük sayıya bakarak sıralamayın. İstek, token, çağrı, dolar ve Neuron farklı birimlerdir; süresi dolan bir deneme, yenilenen bir kota değildir.

Görüntü, konuşma, embedding ve diğer modaliteler için daha kapsamlı ücretsiz AI API karşılaştırmasına göz atın. Bu sayfa yalnızca barındırılan LLM çıkarımına odaklanıyor.

Yenilenen veya kartsız erişimi en net sunan sağlayıcılar

Google AI Studio: genel amaçlı kullanım için pratik başlangıç noktası

Google’ın resmî hız sınırı belgelerine göre Gemini kotaları modele ve projeye özel. Belgelerde yaygın boyutlar olarak RPM, input TPM ve RPD belirtiliyor; kotaların her API anahtarı için değil, Google Cloud projesi için geçerli olduğu açıklanıyor ve güncel değerler için geliştiriciler AI Studio’ya yönlendiriliyor. Günlük istek kotaları Pasifik saatiyle gece yarısında sıfırlanıyor.

İkincil doğrulama, Gemini 2.5 Flash için 10 RPM ve 250 RPD; modeller genelinde ise 5–30 RPM ve 15–1.000 RPD bildiriyor. Google aktif limitlerin değişebileceğini ve garanti edilmediğini söylediği için bunları yalnızca planlama değerleri olarak değerlendirin.

Genel amaçlı ve multimodal prototipler için Gemini iyi bir seçenek. Ancak modele özel günlük limitler, yoğun istek alan iş yüklerini kısıtlayabilir.

Groq: yayınlanan istek kotası açısından en güçlü kartsız seçenek

Groq’un hız sınırı belgeleri limitleri model ve organizasyon bazında listeliyor. qwen/qwen3.6-27b için güncel Free Plan satırında 30 RPM, 1.000 RPD, 8.000 TPM ve 200.000 TPD değerleri yer alıyor. Diğer modellerin günlük ve token sınırları farklı.

“Hız sınırları bireysel kullanıcılar için değil, organizasyon düzeyinde uygulanır.” — Groq hız sınırı belgeleri

Birden fazla API anahtarı, organizasyon genelindeki kapasiteyi otomatik olarak bağımsız kotalara bölmez. Groq belgelerinde HTTP 429 yanıtlarını yönetmek için retry-after ve x-ratelimit-* başlıkları açıklanıyor.

Seçtiğiniz model işinize uygunsa Groq, sık tekrarlanan küçük istekler için en net başlangıç noktası. Ancak sağlayıcı etiketini tek bir kota gibi görmeyin; mutlaka ilgili modelin satırını kontrol edin.

OpenRouter: ücretsiz model seçenekleri için en esnek geçit

OpenRouter, sürekli değişen ücretsiz model varyantlarını tek bir API yüzeyinde bir araya getiriyor. Güncel ücretsiz erişim karşılaştırmasına göre hesapta satın alınan kredi miktarı $10’ın altındayken dakikada 20 istek ve günde 50 istek kullanılabiliyor. Toplamda en az $10 satın alınan kredinin ardından günlük limit 1.000 isteğe yükseliyor. Dolayısıyla yüksek kota için satın alma gerekiyor.

Resmî limit belgeleri, ek hesapların veya API anahtarlarının platformun genel hız sınırlarını değiştirmediğini açıklıyor. Servis, kota bilgilerini anahtar endpoint’i ve hız sınırı hata başlıkları üzerinden sunuyor.

Modeli :free son ekiyle sabitleyebilir veya kullanılabilir ücretsiz modellerden birini otomatik seçen openrouter/free rotasını kullanabilirsiniz. Yönlendirici; araç çağırma veya görüntü anlama gibi yeteneklere göre filtreleme yapabiliyor, ancak kullanılan temel model değişebilir.

OpenRouter’ı deneyler ve yedek rota yönlendirmesi için kullanın. Tek bir ücretsiz modelin davranışına istikrarlı biçimde bağlı olan uygulamalarda ana bağımlılık olarak tercih etmeyin.

Cloudflare Workers AI: ücretsiz token değil, düzenli hesaplama kapasitesi

Cloudflare’ın resmî fiyatlandırma sayfası, her hesaba ücretsiz olarak toplam günde 10.000 Neuron tahsis edildiğini belirtiyor. Bu miktar Workers AI etkinlikleri arasında paylaşılıyor ve 00:00 UTC’de sıfırlanıyor. Workers Free planında tahsisat tükendiğinde sonraki işlemler başarısız oluyor.

Neuron, bir istek için gereken GPU hesaplama gücünü ifade ediyor. Cloudflare, 10.000 Neuron’un sabit sayıda prompt’a denk geldiğini garanti etmek yerine model bazında token karşılıkları yayınlıyor.

Cloudflare ayrıca yeni DeepSeek, GLM ve Kimi modellerinden seçilenlerin ücretli bir faturalandırma yöntemi gerektirdiğini söylüyor. “10.000 Neuron ücretsiz” ifadesi, her modelin faturalandırma olmadan kullanılabildiği anlamına gelmiyor.

Bir koşulla sunulan ücretsiz erişimler

Cerebras: kalıcı ücretsiz API değil, işe yarar bir deneme

Cerebras’ın hız sınırı belgelerinde listelenen Free Trial modelleri için 5 RPM, 30.000 önbelleksiz TPM, 90.000 toplam TPM ve 1 milyon TPD değerleri yer alıyor. Belgeler ayrıca token kovasının basit bir günlük sıfırlamayı beklemek yerine sürekli yenilendiğini açıklıyor.

Yeni hesaplara $5 ücretsiz kredi veriliyor; kredilerin süresi 30 gün sonra doluyor ve Playground ile API erişimini etkinleştirmek için doğrulanmış bir ödeme yöntemi gerekiyor. Kredi sona erdiğinde veya tükendiğinde, yeni kredi satın alınmadığı sürece erişim duruyor. İncelenen belgelerde kalıcı olarak yenilenen herkese açık bir ücretsiz tahsisat tanımlanmıyor.

Cerebras kısa süreli değerlendirmeler için uygun. Deneme süresi sonrasında da çalışması gereken bir projenin tek bağımlılığı olmamalı.

SambaNova Cloud: faturalandırma durumunu en net ayıran seçenek

SambaNova, Free Tier’ı faturalandırma durumuna göre tanımlıyor: bu katman yalnızca herhangi bir ödeme yöntemi bağlı değilse geçerli. Listelenen Free Tier modelleri için resmî belgelerde 20 RPM, 20 RPD ve 200.000 TPD değerleri gösteriliyor. 20 RPD sınırı, token kotası kullanılmadan önce yoklama ağırlıklı bir iş akışını durdurabilir.

Ödeme yöntemi bağlamak, ücretli Developer Tier’ı etkinleştiriyor ve bu katman ücretsiz olarak değerlendirilmemeli. SambaNova ayrıca kalan istek ve sıfırlama bilgilerini yanıt başlıkları üzerinden sunuyor.

SambaNova’yı yalnızca düşük hacimli kavram kanıtları için kullanın. Herhangi bir agent iş akışına geçmeden önce 20 RPD sınırını mutlaka test edin.

Cohere: RAG için kullanışlı, ancak çağrıları dikkatle sayın

Cohere’un deneme anahtarı, token tabanlı bir ücretsiz katmandan farklı çalışıyor. Güncel doğrulamalı karşılaştırmaya göre sınır ayda 1.000 çağrı; endpoint’e özel limitler ise Chat için 20 RPM, Embed için dakikada 2.000 girdi ve Rerank için 10 RPM. Cohere’un SSS bölümü, deneme anahtarlarının ücretsiz ancak sınırlı olduğunu belirtiyor.

Bu yapı, Cohere’u retrieval-augmented generation deneyleri için kullanışlı kılıyor: tek bir projede üretim, embedding ve yeniden sıralamayı test edebilirsiniz. Ancak deneme anahtarını yüksek hacimli bir sohbet backend’i olarak görmeyin. Ayda 1.000 çağrıyı doğrudan günde 1 milyon token ile karşılaştırmayın.

Doğrulanan karşılaştırmada deneme erişimi yalnızca değerlendirme amaçlı olarak etiketleniyor. Herkese açık veya ticari bir uygulamada kullanmadan önce güncel kullanım politikasını doğrulayın.

Z.AI: ücretsiz fiyat, bilinen bir kota anlamına gelmiyor

Z.AI’ın fiyatlandırma belgelerinde GLM-4.7-Flash ve GLM-4.5-Flash, gösterilen token kategorileri için ücretsiz olarak listeleniyor. İncelenen herkese açık fiyatlandırma sayfasında somut bir RPM, RPD, TPM veya TPD değeri bulunmuyor.

Z.AI kotasını bilinmeyen olarak değerlendirin. Manuel testler için uygun olabilir, ancak toplu işler için güvenmeden önce kayıt sırasında endpoint’i, model erişilebilirliğini ve kullanım şartlarını doğrulayın.

NVIDIA, Hugging Face ve Mistral: kota verisi eksik keşif rotaları

SağlayıcıÜcretsiz erişim sinyaliEksik olan herkese açık kota bilgisiPratik kullanım
NVIDIA NIMPrototip geliştirme için Free Inference EndpointsAçılış sayfasında genel RPM, token tahsisi, kart kuralı veya aşım ücreti yokSeçtiğiniz endpoint’i test edin, ardından modele özel şartları okuyun
Hugging Face Inference ProvidersDeğişiklik gösterebilen şekilde Free kullanıcılarına aylık $0.10 krediKarşılaştırılabilir bir RPM veya TPM kotası yokGPU altyapısını yönetmeden küçük ölçekli yönlendirilmiş model deneyleri
Mistral StudioStudio Free mode ve API hızlı başlangıçlarıDokümantasyon ana sayfasında kota veya kart kuralı yokÜcretli bir kuruluma geçmeden önce Mistral API özelliklerini deneyin

Hangi ücretsiz LLM API’yi seçmelisiniz?

ÖnceliğinizBaşlangıç için en iyi seçenekNedeni
Genel amaçlı prototipGoogle AI StudioGemini net bir genel amaçlı temel sunuyor; aktif limitler AI Studio’da görülebiliyor
Sık ve küçük isteklerGroqYayınlanmış model bazlı Free Plan satırları ve 1.000 RPD örneği var
Tek API üzerinden çok sayıda modelOpenRouterÜcretsiz varyantlar, yönlendirme ve OpenAI tarzı arayüz
Cloudflare tabanlı uygulamaWorkers AIYenilenen günde 10.000 Neuron tahsisi
Belirtilen en yüksek deneme token kotasıCerebrasEn fazla 1M TPD, ancak yalnızca 30 günlük ve kart gerektiren denemede
Ödeme yöntemi eklemeden kurulumÖnce Groq; çok düşük hacim için SambaNovaSambaNova Free Tier’da 20 RPD sınırı var
RAG bileşenleriCohereChat, Embed ve Rerank aynı deneme anahtarı ekosistemini paylaşıyor
GLM Flash testleriZ.AIGösterilen token fiyatı $0, ancak herkese açık kota bilinmiyor
GPU olmadan açık model keşfiHugging FaceYönlendirilmiş erişim ve Free kullanıcılarına aylık $0.10

Tek bir sağlayıcıyla başlayın ve her istekte şu dört alanı kaydedin: model ID’si, HTTP durumu, token kullanımı ve kalan limit başlıkları. İlk rotanın hangi sınıra ulaştığını anlamadan ikinci sağlayıcıyı eklemeyin; birden fazla anahtar kullanmak mutlaka daha fazla kapasite yaratmaz.

Ücretsiz bir LLM API’yi kullanmadan önce nasıl doğrulanır?

Canlıya almadan önce şu beş noktayı kontrol edin:

  1. Kota birimi: Teklif istek, token, çağrı, dolar veya hesaplama birimi üzerinden mi ölçülüyor?
  2. Sıfırlama davranışı: Kota UTC ya da Pasifik saatiyle belirli bir saatte mi sıfırlanıyor, sürekli mi yenileniyor, aylık mı yenileniyor, yoksa tek seferlik olup süresi mi doluyor?
  3. Kapsam: Limit model, proje, hesap veya organizasyon düzeyinde mi uygulanıyor?
  4. Ödeme koşulu: Kart eklemek daha fazla kapasitenin kilidini mi açıyor, ücretli bir katmanı mı etkinleştiriyor, yoksa deneme için zorunlu mu?
  5. Şartlar ve hata senaryosu: Teklif yalnızca test veya değerlendirme ile mi sınırlı ve istemci, HTTP 429 yanıtlarını bir yeniden deneme fırtınası oluşturmadan yönetebiliyor mu?

Ücretsiz LLM API SSS

Genel olarak en iyi ücretsiz LLM API hangisi?

Google AI Studio genel amaçlı prototipler için, Groq daha yüksek ücretsiz istek hacmi için, OpenRouter ise model çeşitliliği için uygun.

Ücretsiz bir LLM API’yi kredi kartı olmadan kullanabilir miyim?

Evet. Doğrulanan karşılaştırmada Google, Groq, OpenRouter’ın temel rotası, Cloudflare’ın temel tahsisi ve SambaNova’nın Free Tier’ı kartsız seçenekler olarak listeleniyor. Cerebras Free Trial için doğrulanmış bir ödeme yöntemi gerekiyor.

Ücretsiz LLM API’ler gerçekten kalıcı mı?

Bazı yenilenen katmanlar, şartları geçerli olduğu sürece kullanılabilir. Ancak denemeler, promosyon fiyatları ve dönen :free rotaları sağlayıcı genelinde kalıcı kotalar değildir. Bir seçeneğe güvenmeden önce güncel belgeleri ve model durumunu kontrol edin.

Ücretsiz bir LLM API’yi üretimde kullanabilir miyim?

Güncel şartları, kotası ve model erişilebilirliği üretim gereksinimlerinizi karşılamıyorsa ücretsiz bir API’yi tek backend olarak kullanmayın.

Ücretsiz limite ulaştığımda ne olur?

Sağlayıcılar genellikle hız sınırlaması veya kota hatası döndürür. Groq HTTP 429 yönetimini belgeliyor, Cloudflare günlük Free plan tahsisi tükendiğinde sonraki işlemlerin başarısız olduğunu söylüyor; Cerebras ise kredisi sona erdiğinde veya tükendiğinde deneme erişimini durduruyor.

>_AIReiter Model Dizini

Bu rehberle ilgili modellere hızlı API erişimi

Gemini 3.6 Flash

Chat

Gelişmiş akıl yürütme, kodlama ve ajanik görevler için hızlı bir Gemini modeli.

GoogleAPI Key oluştur >

Gemini 2.5 Pro

Chat
GoogleAPI Key oluştur >

Claude Fable 5

Chat

Derin muhakeme ve karmaşık uzun biçimli çalışmalar için premium bir Claude modeli.

AnthropicAPI Key oluştur >

Claude Fable 5.1

Chat

Mythos-class model for long-horizon coding, research, and knowledge work.

AnthropicAPI Key oluştur >

Claude Opus 4.8

Chat

Zorlu akıl yürütme ve profesyonel işler için yüksek yetenekli bir Claude modeli.

AnthropicAPI Key oluştur >

Son yazılar

Janitor AI'da DeepSeek Nasıl Kullanılır? (2026 Kurulumu)

2026-09-08

Muse Spark 1.3 API Fiyatlandırması: Standard ve Contributor Karşılaştırması

2026-09-08

GPT-6 Astra API İncelemesi (2026): Ajanlar İçin Tasarlandı, Doğrudan İkame Değil

2026-09-07

Kling API Entegrasyon Rehberi: Resmî Platform mu, Aggregator mı? (2026)

2026-09-07
AIREITER

Sorularınız mı var? Bize ulaşın
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

AI Video

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

AI Görsel

Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image TurboKrea 2 Turbo

Blog

Tümünü Görüntüle →

Şirket

Gizlilik PolitikasıHizmet Şartlarıİade Politikası

© 2026 AIReiter. Tüm hakları saklıdır.