Ücretsiz LLM API karşılaştırması: hızlı bakış
Bu tablo 8 Eylül 2026 tarihinde kontrol edildi. Limitler modele, hesaba, bölgeye ve talebe göre değişebilir; son karar için sağlayıcının bağlantısı verilen belgelerini esas alın.
Kart, ticari kullanım ve OpenAI uyumluluğu etiketleri, ikincil bir kontrol olarak Free LLM API Hub karşılaştırmasından yararlanır.
| Sağlayıcı | Ücretsiz erişim ve yayınlanan kota | Kart/ödeme koşulu | API yapısı | Kullanım şartı sinyali | Temel sınırlama |
|---|---|---|---|---|---|
| Google AI Studio | Gemini modellerine göre değişir: 5–30 RPM ve 15–1.000 RPD; Gemini 2.5 Flash örneği: 10 RPM / 250 RPD | Kart belirtilmiyor; hesap ve proje doğrulaması gerekebilir | Doğrulanan karşılaştırmaya göre OpenAI uyumlu | Ticari kullanım uygun olarak listeleniyor; güncel şartları doğrulayın | Google, geçerli limitlerin AI Studio’dan kontrol edilmesi gerektiğini söylüyor |
| Groq | Örnek qwen/qwen3.6-27b: 30 RPM / 1.000 RPD / 8.000 TPM / 200.000 TPD | Free Plan için ücretli yükseltme gerekmiyor; Developer katmanı ödeme yöntemi istiyor | Evet, büyük ölçüde | Ticari kullanım uygun olarak listeleniyor; Free Plan limitleri ücretli kapasiteden farklı | Limitler organizasyon ve model düzeyinde uygulanıyor |
| OpenRouter | Ücretsiz varyantlar: satın alınan kredi $10 altında ise 20 RPM / 50 RPD; en az $10 satın alındığında 1.000 RPD | Temel ücretsiz rota için kart gerekmiyor; kredi daha yüksek kotanın kilidini açıyor | Evet, OpenAI Chat API’ye normalize edilmiş | Ticari kullanım uygun olarak listeleniyor; ücretsiz model seçenekleri değişebilir | Daha yüksek günlük kota satın alma koşuluna bağlı |
| Cloudflare Workers AI | Hesap genelinde paylaşılan günde 10.000 Neuron; 00:00 UTC’de sıfırlanıyor | Temel tahsis ücretsiz; seçili modeller ücretli faturalandırma gerektiriyor | Doğrulanan karşılaştırmaya göre OpenAI uyumlu | Ticari kullanım uygun olarak listeleniyor; model uygunluğu değişiyor | Neuron, sabit token kotasını değil hesaplama maliyetini ölçüyor |
| Cerebras Inference | Free Trial: listelenen modeller için 5 RPM / 30K önbelleksiz TPM / 90K toplam TPM / 1M TPD | Doğrulanmış ödeme yöntemi gerekiyor | Atıf yapılan belgelerde belirlenmemiş | Deneme erişimi; krediler 30 gün sonra sona eriyor | $5 deneme kredisi kalıcı değil |
| SambaNova Cloud | Free Tier: listelenen modeller için 20 RPM / 20 RPD / 200.000 TPD | Free Tier’da ödeme yöntemi yok; kart bağlamak ücretli Developer Tier’ı etkinleştiriyor | Evet, belgelenmiş farklılıklarla | Ticari kullanım uygun olarak listeleniyor; model şartlarını kontrol edin | 20 RPD limiti oldukça kısıtlayıcı |
| Cohere | Ayda 1.000 çağrı; Chat 20 RPM, Embed dakikada 2.000 girdi, Rerank 10 RPM | Doğrulanan karşılaştırmada kart belirtilmiyor; kayıt sırasında doğrulayın | Doğrulanan karşılaştırmaya göre OpenAI uyumlu | Doğrulanan karşılaştırmada yalnızca değerlendirme amaçlı | Çağrılar tokenlarla aynı şey değil |
| Z.AI | GLM-4.7-Flash ve GLM-4.5-Flash, gösterilen token kategorileri için $0 olarak listeleniyor; herkese açık RPM/TPM bilgisi belirtilmemiş | Doğrulanan karşılaştırmada kart belirtilmiyor | Doğrulanan karşılaştırmaya göre OpenAI uyumlu | Ticari kullanım uygun olarak listeleniyor; model şartlarını doğrulayın | Token başına $0 fiyat, kapasite hakkında bilgi vermiyor |
| NVIDIA NIM | Prototip geliştirme için Free Inference Endpoints; açılış sayfasında genel bir kota yok | Ödeme koşulu endpoint’e göre değişiyor; model sayfasını kontrol edin | Atıf yapılan belgelerde belirlenmemiş | Atıf yapılan sayfada prototip/değerlendirme sinyali var | Açılış sayfasındaki ücretsiz etiketi, yayınlanmış bir kota anlamına gelmiyor |
| Hugging Face Inference Providers | Ücretsiz kullanıcılar değişiklik gösterebilen şekilde aylık $0.10 kredi alıyor; RPM/TPM yayınlanmamış | Resmî fiyatlandırma belgelerinde kart koşulu belirtilmiyor | Doğrulanan karşılaştırmaya göre OpenAI uyumlu | Sağlayıcı ve model şartlarını kontrol edin | Bu bir istek kotası değil, küçük bir kredi |
| Mistral Studio | Studio Free mode; dokümantasyon ana sayfasında herkese açık kota yok | Ana sayfada kart koşulu belirtilmiyor | OpenAI tarzı endpoint belgelenmiş; tam uyumluluk iddia edilmiyor | Deneme ve keşif/değerlendirme sinyali var; şartları doğrulayın | Free mode, sınırsız veya üretime hazır erişimin kanıtı değil |
Satırları yalnızca en büyük sayıya bakarak sıralamayın. İstek, token, çağrı, dolar ve Neuron farklı birimlerdir; süresi dolan bir deneme, yenilenen bir kota değildir.
Görüntü, konuşma, embedding ve diğer modaliteler için daha kapsamlı ücretsiz AI API karşılaştırmasına göz atın. Bu sayfa yalnızca barındırılan LLM çıkarımına odaklanıyor.
Yenilenen veya kartsız erişimi en net sunan sağlayıcılar
Google AI Studio: genel amaçlı kullanım için pratik başlangıç noktası
Google’ın resmî hız sınırı belgelerine göre Gemini kotaları modele ve projeye özel. Belgelerde yaygın boyutlar olarak RPM, input TPM ve RPD belirtiliyor; kotaların her API anahtarı için değil, Google Cloud projesi için geçerli olduğu açıklanıyor ve güncel değerler için geliştiriciler AI Studio’ya yönlendiriliyor. Günlük istek kotaları Pasifik saatiyle gece yarısında sıfırlanıyor.
İkincil doğrulama, Gemini 2.5 Flash için 10 RPM ve 250 RPD; modeller genelinde ise 5–30 RPM ve 15–1.000 RPD bildiriyor. Google aktif limitlerin değişebileceğini ve garanti edilmediğini söylediği için bunları yalnızca planlama değerleri olarak değerlendirin.
Genel amaçlı ve multimodal prototipler için Gemini iyi bir seçenek. Ancak modele özel günlük limitler, yoğun istek alan iş yüklerini kısıtlayabilir.
Groq: yayınlanan istek kotası açısından en güçlü kartsız seçenek
Groq’un hız sınırı belgeleri limitleri model ve organizasyon bazında listeliyor. qwen/qwen3.6-27b için güncel Free Plan satırında 30 RPM, 1.000 RPD, 8.000 TPM ve 200.000 TPD değerleri yer alıyor. Diğer modellerin günlük ve token sınırları farklı.
“Hız sınırları bireysel kullanıcılar için değil, organizasyon düzeyinde uygulanır.” — Groq hız sınırı belgeleri
Birden fazla API anahtarı, organizasyon genelindeki kapasiteyi otomatik olarak bağımsız kotalara bölmez. Groq belgelerinde HTTP 429 yanıtlarını yönetmek için retry-after ve x-ratelimit-* başlıkları açıklanıyor.
Seçtiğiniz model işinize uygunsa Groq, sık tekrarlanan küçük istekler için en net başlangıç noktası. Ancak sağlayıcı etiketini tek bir kota gibi görmeyin; mutlaka ilgili modelin satırını kontrol edin.
OpenRouter: ücretsiz model seçenekleri için en esnek geçit
OpenRouter, sürekli değişen ücretsiz model varyantlarını tek bir API yüzeyinde bir araya getiriyor. Güncel ücretsiz erişim karşılaştırmasına göre hesapta satın alınan kredi miktarı $10’ın altındayken dakikada 20 istek ve günde 50 istek kullanılabiliyor. Toplamda en az $10 satın alınan kredinin ardından günlük limit 1.000 isteğe yükseliyor. Dolayısıyla yüksek kota için satın alma gerekiyor.
Resmî limit belgeleri, ek hesapların veya API anahtarlarının platformun genel hız sınırlarını değiştirmediğini açıklıyor. Servis, kota bilgilerini anahtar endpoint’i ve hız sınırı hata başlıkları üzerinden sunuyor.
Modeli :free son ekiyle sabitleyebilir veya kullanılabilir ücretsiz modellerden birini otomatik seçen openrouter/free rotasını kullanabilirsiniz. Yönlendirici; araç çağırma veya görüntü anlama gibi yeteneklere göre filtreleme yapabiliyor, ancak kullanılan temel model değişebilir.
OpenRouter’ı deneyler ve yedek rota yönlendirmesi için kullanın. Tek bir ücretsiz modelin davranışına istikrarlı biçimde bağlı olan uygulamalarda ana bağımlılık olarak tercih etmeyin.
Cloudflare Workers AI: ücretsiz token değil, düzenli hesaplama kapasitesi
Cloudflare’ın resmî fiyatlandırma sayfası, her hesaba ücretsiz olarak toplam günde 10.000 Neuron tahsis edildiğini belirtiyor. Bu miktar Workers AI etkinlikleri arasında paylaşılıyor ve 00:00 UTC’de sıfırlanıyor. Workers Free planında tahsisat tükendiğinde sonraki işlemler başarısız oluyor.
Neuron, bir istek için gereken GPU hesaplama gücünü ifade ediyor. Cloudflare, 10.000 Neuron’un sabit sayıda prompt’a denk geldiğini garanti etmek yerine model bazında token karşılıkları yayınlıyor.
Cloudflare ayrıca yeni DeepSeek, GLM ve Kimi modellerinden seçilenlerin ücretli bir faturalandırma yöntemi gerektirdiğini söylüyor. “10.000 Neuron ücretsiz” ifadesi, her modelin faturalandırma olmadan kullanılabildiği anlamına gelmiyor.
Bir koşulla sunulan ücretsiz erişimler
Cerebras: kalıcı ücretsiz API değil, işe yarar bir deneme
Cerebras’ın hız sınırı belgelerinde listelenen Free Trial modelleri için 5 RPM, 30.000 önbelleksiz TPM, 90.000 toplam TPM ve 1 milyon TPD değerleri yer alıyor. Belgeler ayrıca token kovasının basit bir günlük sıfırlamayı beklemek yerine sürekli yenilendiğini açıklıyor.
Yeni hesaplara $5 ücretsiz kredi veriliyor; kredilerin süresi 30 gün sonra doluyor ve Playground ile API erişimini etkinleştirmek için doğrulanmış bir ödeme yöntemi gerekiyor. Kredi sona erdiğinde veya tükendiğinde, yeni kredi satın alınmadığı sürece erişim duruyor. İncelenen belgelerde kalıcı olarak yenilenen herkese açık bir ücretsiz tahsisat tanımlanmıyor.
Cerebras kısa süreli değerlendirmeler için uygun. Deneme süresi sonrasında da çalışması gereken bir projenin tek bağımlılığı olmamalı.
SambaNova Cloud: faturalandırma durumunu en net ayıran seçenek
SambaNova, Free Tier’ı faturalandırma durumuna göre tanımlıyor: bu katman yalnızca herhangi bir ödeme yöntemi bağlı değilse geçerli. Listelenen Free Tier modelleri için resmî belgelerde 20 RPM, 20 RPD ve 200.000 TPD değerleri gösteriliyor. 20 RPD sınırı, token kotası kullanılmadan önce yoklama ağırlıklı bir iş akışını durdurabilir.
Ödeme yöntemi bağlamak, ücretli Developer Tier’ı etkinleştiriyor ve bu katman ücretsiz olarak değerlendirilmemeli. SambaNova ayrıca kalan istek ve sıfırlama bilgilerini yanıt başlıkları üzerinden sunuyor.
SambaNova’yı yalnızca düşük hacimli kavram kanıtları için kullanın. Herhangi bir agent iş akışına geçmeden önce 20 RPD sınırını mutlaka test edin.
Cohere: RAG için kullanışlı, ancak çağrıları dikkatle sayın
Cohere’un deneme anahtarı, token tabanlı bir ücretsiz katmandan farklı çalışıyor. Güncel doğrulamalı karşılaştırmaya göre sınır ayda 1.000 çağrı; endpoint’e özel limitler ise Chat için 20 RPM, Embed için dakikada 2.000 girdi ve Rerank için 10 RPM. Cohere’un SSS bölümü, deneme anahtarlarının ücretsiz ancak sınırlı olduğunu belirtiyor.
Bu yapı, Cohere’u retrieval-augmented generation deneyleri için kullanışlı kılıyor: tek bir projede üretim, embedding ve yeniden sıralamayı test edebilirsiniz. Ancak deneme anahtarını yüksek hacimli bir sohbet backend’i olarak görmeyin. Ayda 1.000 çağrıyı doğrudan günde 1 milyon token ile karşılaştırmayın.
Doğrulanan karşılaştırmada deneme erişimi yalnızca değerlendirme amaçlı olarak etiketleniyor. Herkese açık veya ticari bir uygulamada kullanmadan önce güncel kullanım politikasını doğrulayın.
Z.AI: ücretsiz fiyat, bilinen bir kota anlamına gelmiyor
Z.AI’ın fiyatlandırma belgelerinde GLM-4.7-Flash ve GLM-4.5-Flash, gösterilen token kategorileri için ücretsiz olarak listeleniyor. İncelenen herkese açık fiyatlandırma sayfasında somut bir RPM, RPD, TPM veya TPD değeri bulunmuyor.
Z.AI kotasını bilinmeyen olarak değerlendirin. Manuel testler için uygun olabilir, ancak toplu işler için güvenmeden önce kayıt sırasında endpoint’i, model erişilebilirliğini ve kullanım şartlarını doğrulayın.
NVIDIA, Hugging Face ve Mistral: kota verisi eksik keşif rotaları
| Sağlayıcı | Ücretsiz erişim sinyali | Eksik olan herkese açık kota bilgisi | Pratik kullanım |
|---|---|---|---|
| NVIDIA NIM | Prototip geliştirme için Free Inference Endpoints | Açılış sayfasında genel RPM, token tahsisi, kart kuralı veya aşım ücreti yok | Seçtiğiniz endpoint’i test edin, ardından modele özel şartları okuyun |
| Hugging Face Inference Providers | Değişiklik gösterebilen şekilde Free kullanıcılarına aylık $0.10 kredi | Karşılaştırılabilir bir RPM veya TPM kotası yok | GPU altyapısını yönetmeden küçük ölçekli yönlendirilmiş model deneyleri |
| Mistral Studio | Studio Free mode ve API hızlı başlangıçları | Dokümantasyon ana sayfasında kota veya kart kuralı yok | Ücretli bir kuruluma geçmeden önce Mistral API özelliklerini deneyin |
Hangi ücretsiz LLM API’yi seçmelisiniz?
| Önceliğiniz | Başlangıç için en iyi seçenek | Nedeni |
|---|---|---|
| Genel amaçlı prototip | Google AI Studio | Gemini net bir genel amaçlı temel sunuyor; aktif limitler AI Studio’da görülebiliyor |
| Sık ve küçük istekler | Groq | Yayınlanmış model bazlı Free Plan satırları ve 1.000 RPD örneği var |
| Tek API üzerinden çok sayıda model | OpenRouter | Ücretsiz varyantlar, yönlendirme ve OpenAI tarzı arayüz |
| Cloudflare tabanlı uygulama | Workers AI | Yenilenen günde 10.000 Neuron tahsisi |
| Belirtilen en yüksek deneme token kotası | Cerebras | En fazla 1M TPD, ancak yalnızca 30 günlük ve kart gerektiren denemede |
| Ödeme yöntemi eklemeden kurulum | Önce Groq; çok düşük hacim için SambaNova | SambaNova Free Tier’da 20 RPD sınırı var |
| RAG bileşenleri | Cohere | Chat, Embed ve Rerank aynı deneme anahtarı ekosistemini paylaşıyor |
| GLM Flash testleri | Z.AI | Gösterilen token fiyatı $0, ancak herkese açık kota bilinmiyor |
| GPU olmadan açık model keşfi | Hugging Face | Yönlendirilmiş erişim ve Free kullanıcılarına aylık $0.10 |
Tek bir sağlayıcıyla başlayın ve her istekte şu dört alanı kaydedin: model ID’si, HTTP durumu, token kullanımı ve kalan limit başlıkları. İlk rotanın hangi sınıra ulaştığını anlamadan ikinci sağlayıcıyı eklemeyin; birden fazla anahtar kullanmak mutlaka daha fazla kapasite yaratmaz.
Ücretsiz bir LLM API’yi kullanmadan önce nasıl doğrulanır?
Canlıya almadan önce şu beş noktayı kontrol edin:
- Kota birimi: Teklif istek, token, çağrı, dolar veya hesaplama birimi üzerinden mi ölçülüyor?
- Sıfırlama davranışı: Kota UTC ya da Pasifik saatiyle belirli bir saatte mi sıfırlanıyor, sürekli mi yenileniyor, aylık mı yenileniyor, yoksa tek seferlik olup süresi mi doluyor?
- Kapsam: Limit model, proje, hesap veya organizasyon düzeyinde mi uygulanıyor?
- Ödeme koşulu: Kart eklemek daha fazla kapasitenin kilidini mi açıyor, ücretli bir katmanı mı etkinleştiriyor, yoksa deneme için zorunlu mu?
- Şartlar ve hata senaryosu: Teklif yalnızca test veya değerlendirme ile mi sınırlı ve istemci, HTTP 429 yanıtlarını bir yeniden deneme fırtınası oluşturmadan yönetebiliyor mu?
Ücretsiz LLM API SSS
Genel olarak en iyi ücretsiz LLM API hangisi?
Google AI Studio genel amaçlı prototipler için, Groq daha yüksek ücretsiz istek hacmi için, OpenRouter ise model çeşitliliği için uygun.
Ücretsiz bir LLM API’yi kredi kartı olmadan kullanabilir miyim?
Evet. Doğrulanan karşılaştırmada Google, Groq, OpenRouter’ın temel rotası, Cloudflare’ın temel tahsisi ve SambaNova’nın Free Tier’ı kartsız seçenekler olarak listeleniyor. Cerebras Free Trial için doğrulanmış bir ödeme yöntemi gerekiyor.
Ücretsiz LLM API’ler gerçekten kalıcı mı?
Bazı yenilenen katmanlar, şartları geçerli olduğu sürece kullanılabilir. Ancak denemeler, promosyon fiyatları ve dönen :free rotaları sağlayıcı genelinde kalıcı kotalar değildir. Bir seçeneğe güvenmeden önce güncel belgeleri ve model durumunu kontrol edin.
Ücretsiz bir LLM API’yi üretimde kullanabilir miyim?
Güncel şartları, kotası ve model erişilebilirliği üretim gereksinimlerinizi karşılamıyorsa ücretsiz bir API’yi tek backend olarak kullanmayın.
Ücretsiz limite ulaştığımda ne olur?
Sağlayıcılar genellikle hız sınırlaması veya kota hatası döndürür. Groq HTTP 429 yönetimini belgeliyor, Cloudflare günlük Free plan tahsisi tükendiğinde sonraki işlemlerin başarısız olduğunu söylüyor; Cerebras ise kredisi sona erdiğinde veya tükendiğinde deneme erişimini durduruyor.