Ücretsiz yapay zekâ API limitlerine hızlı bakış
Yapay zekâ API dünyasında “ücretsiz” neredeyse hiçbir zaman sınırsız anlamına gelmiyor. Genellikle hız sınırı olan bir katmandan söz ediyoruz: kimi zaman kalıcı bir kota, kimi zamansa tükenebilen promosyon kredileri. Aşağıdaki sağlayıcıların tamamı kredi kartı istemeden API anahtarı veriyor. Ancak kullanılabilir kapasite günlük birkaç istekten on binlerce isteğe kadar değişiyor.
Bu rehberdeki rakamlar, her sağlayıcının resmî dokümantasyonu üzerinden Ağustos 2026'da kontrol edildi. Hız limitleri sık sık değişebildiği için üretim planlamasında herhangi bir sayıya güvenmeden önce sağlayıcının konsolundaki güncel değerleri mutlaka doğrulayın.
| Sağlayıcı | Ücretsiz katmanın öne çıkanları | Veri politikası notu | En uygun kullanım |
|---|---|---|---|
| Google AI Studio | Kart veya faturalandırma hesabı gerektirmez; Gemini modelleri; proje başına kotalar Pasifik gece yarısında sıfırlanır | Ücretsiz istemler Google ürünlerini eğitmek için kullanılır | Model çeşitliliği, prototipleme |
| Groq | Llama 3.1 8B'de günlük 14.400 istek; Compound modellerinde dakikada 70 bin token | Varsayılan olarak veri saklanmaz; ZDR kullanılabilir | Yüksek frekanslı kısa istemler |
| OpenRouter | Günde 50 ücretsiz istek; 25'ten fazla ücretsiz model; BYOK desteği | Üst sağlayıcıya göre değişir | Birçok modeli test etmek |
| GitHub Models | Düşük katmanda dakikada 15 / günde 150 istek; 8.000 giriş + 4.000 çıkış token'ı | Microsoft veri şartları geçerli | PAT ile hızlı denemeler |
| Cloudflare Workers AI | Günde 10.000 Neuron (Llama 3.1 8B Fast'te yaklaşık 280 bin çıktı token'ı) | Eğitimde kullanmama yönünde açık taahhüt | Gizliliğin önemli olduğu işler |
| Cohere | dakikada 20 istek; ayda 1.000 çağrı | Değerlendirme lisansı | Embeddings ve yeniden sıralama denemeleri |
| NVIDIA NIM | Kayıtla 1.000 kredi; kurumsal e-postayla 5.000'e kadar | Ücretsiz uç nokta kullanımı kayda alınır | Tek seferlik model testleri |
| Hugging Face | 200'den fazla modelde ayda $0,10 | Tanımlanan tahsis değişebilir | Demo ölçeğinde çıkarım |
| Mistral | Ücretsiz API anahtarı modu; limitler Admin Panel'de | Sıfır saklama seçeneğinden söz ediliyor | Avrupa'da barındırılan modeller |
Dokuz sağlayıcı kredi kartı olmadan anahtar veriyor. Bunların yedisi düzenli olarak yenilenen ücretsiz katmanlar sunarken NVIDIA ve Hugging Face yenilenmeyen, tüketilebilir krediler sağlıyor. Aradaki fark oldukça büyük: GitHub Models size günde 8 DeepSeek-R1 isteği verirken Groq, Llama 3.1 8B için günlük 14.400 istek sunuyor.
Google AI Studio: ücretsiz katman için en mantıklı başlangıç
Faturalandırma bilgisi girmeden üst seviye modellere ücretsiz erişmek isteyenler için Google AI Studio doğal başlangıç noktası. Kredi kartı ya da faturalandırma hesabı gerekmiyor; Google hesabınızla giriş yapıp API anahtarınızı oluşturduktan sonra çağrılara başlayabiliyorsunuz.
Ücretsiz katmanda Gemini model ailesine erişim var: Gemini 3.6 Flash, 3.5 Flash, 2.5 Pro ve diğerleri. Metin ve embedding uç noktaları da pakete dahil. Kotalar proje bazında belirleniyor ve Pasifik saatine göre gece yarısında sıfırlanıyor.
Kotanızı ancak kayıt olduktan sonra görebiliyorsunuz
Google, Groq veya OpenRouter gibi tek bir “ücretsiz katman” hız limiti tablosu yayımlamıyor. Dakikadaki istek sayısı, dakikadaki token sayısı ve günlük token kotası gibi gerçek limitler, ancak proje oluşturduktan sonra AI Studio konsolunda görünüyor. Bu da kapasiteyi önceden planlamayı zorlaştırıyor. En pratik yol bir proje oluşturmak, Quotas sayfasını açmak ve gördüğünüz üst sınıra göre tasarım yapmak.
Ücretsiz katmanda istemleriniz Google ürünlerini eğitiyor
Buradaki en büyük çekince bu. Google'ın ücretsiz katman şartlarına göre istemleriniz ve oluşturulan içerikler Google ürünlerini geliştirmek için kullanılabilir. Hassas, kuruma özel veya kişisel verilerle çalışıyorsanız bu durum ücretsiz katmanı kullanım senaryonuz için eliyor. Google Cloud üzerinden, faturalandırma hesabıyla kullanılan ücretli Gemini API'de bu eğitim maddesi bulunmuyor; ancak bunun için kredi kartı gerekiyor.
Gemini üzerinden ücretsiz görsel üretimi de kullanılamıyor; ücretsiz kapsam yalnızca metin ve embedding'lerle sınırlı.
Groq: net günlük limitler
Yüksek frekanslı ve kısa istemlerden oluşan iş yüklerinde en cömert ücretsiz katman Groq'ta. Limitler Groq dokümantasyonunda açıkça yayımlanıyor ve kullanıcı başına değil, kuruluş başına uygulanıyor. Önbelleğe alınan token'lar hız limitlerine dahil edilmiyor.
| Model | RPM | RPD | TPM | TPD |
|---|---|---|---|---|
| Llama 3.1 8B Instant | 30 | 14.400 | 6.000 | 500.000 |
| Llama 3.3 70B Versatile | 30 | 1.000 | 12.000 | 100.000 |
| GPT-OSS-120B | 30 | 1.000 | 8.000 | 200.000 |
| GPT-OSS-20B | 30 | 1.000 | 8.000 | 200.000 |
| Qwen 3.6-27B | 30 | 1.000 | 8.000 | 200.000 |
| Groq Compound | 30 | 250 | 70.000 | — |
| Groq Compound Mini | 30 | 250 | 70.000 | — |
| Whisper Large V3 | 20 | 2.000 | — | günde 28.800 ses saniyesi |
En dikkat çekici rakam, Llama 3.1 8B'nin günlük 14.400 istek kotası. Bu, ciddi prototip çalışmaları veya düşük trafikli bir üretim uç noktası için yeterli olabilir. Compound modelleri dakikada 70.000 token ile en yüksek TPM değerini sunuyor; ancak günlük istek sınırları 250 RPD ile daha düşük.
Groq, çıkarım verilerini varsayılan olarak saklamıyor ve Zero Data Retention (ZDR) seçeneği sunuyor. Bu özellikler onu ücretsiz sağlayıcılar arasındaki güçlü gizlilik seçeneklerinden biri haline getiriyor. Temel sınırlama ise 8B modelindeki dakikada 6.000 token sınırı. Uzun bağlamlı veya yüksek hacimli üretimlerde bu sınır darboğaz yaratabilir.
OpenRouter: günde 50 ücretsiz istek
OpenRouter bir model barındırıcısından çok API ağ geçidi olarak çalışıyor. Ücretsiz katman, OpenRouter'ın sübvanse ettiği ve sürekli değişebilen model havuzunu kullanmanıza izin veriyor. Bunun için model adının sonuna :free ekleyebilir veya openrouter/free otomatik yönlendiricisini kullanabilirsiniz.
Hız limitleri: Ücretsiz modeller dakikada 20 istek ve günde 50 istekle sınırlı. Tek seferlik $10 kredi satın alındığında kalıcı günlük ücretsiz model kotası 1.000 isteğe çıkıyor. Bunlara ek olarak üst sağlayıcının kendi kısıtlamaları da uygulanabilir.
Ücretsiz model kataloğu: Ağustos 2026 itibarıyla OpenRouter'da metin üretimi, embedding ve yeniden sıralama alanlarına yayılan 25'ten fazla ücretsiz model bulunuyor; bu sayı temmuzdaki 15 modelden yükselmiş durumda. Listede NVIDIA'nın 1M token'a kadar bağlam sunan Nemotron 3 Ultra, Super ve Nano aileleri, Google'ın Gemma 4'ü, Cohere'ın North Mini Code'u, OpenAI'ın gpt-oss-20b'si ve başka modeller yer alıyor. Sağlayıcılar ücretsiz uç noktalar ekleyip kaldırdıkça katalog da sık sık değişiyor.
BYOK (Bring Your Own Key): OpenRouter, 60'tan fazla çıkarım sağlayıcısı için BYOK desteği sunuyor. Kendi sağlayıcı API anahtarlarınızı verdiğinizde çıkarım ücretini doğrudan ilgili sağlayıcı kesiyor; OpenRouter ise yalnızca yönlendirme katmanı için ücret alıyor. Ücretsiz BYOK hakkı artık plana göre değişiyor ve sabit istek sayısı yerine liste fiyatındaki çıkarım maliyetiyle ölçülüyor. Güncel şartlar için OpenRouter fiyatlandırma sayfasını kontrol edin.
Pratik açıdan önemli nokta şu: OpenRouter'daki “ücretsiz”, token başına ücret alınmadığı anlamına geliyor; verilerin mutlaka saklanmayacağı anlamına gelmiyor. Üst sağlayıcıların kendi veri politikaları var. NVIDIA ve Poolside dahil bazıları ücretsiz uç nokta kullanımını açıkça kaydediyor veya istemleri eğitim amacıyla kullanabiliyor. Gerekiyorsa her sağlayıcı için gizlilik filtrelerini ayrı ayrı yapılandırın.
Altı ücretsiz katman daha
GitHub Models
GitHub Models, GitHub Personal Access Token (PAT) kullanarak popüler modeller için bir oyun alanı ve API uç noktası sunuyor. Düşük katmanda dakikada 15, günde 150 istek hakkı var; yüksek katmanda ise bu değerler dakikada 10 ve günde 50 isteğe düşüyor. Her istek 8.000 giriş token'ı ve 4.000 çıkış token'ıyla sınırlı. DeepSeek-R1 kullanılabiliyor ancak günlük 8 istekle kısıtlanıyor.
PAT tabanlı kimlik doğrulama için ayrıca kayıt olmak gerekmemesi, GitHub Models'ı hızlı denemeler için pratik hale getiriyor. Ancak sıkı token ve istek limitleri, platformu prototiplemenin ötesinde kullanmayı zorlaştırıyor.
Cloudflare Workers AI
Cloudflare Workers AI her hesaba, 00:00 UTC'de sıfırlanan günlük 10.000 Neuron veriyor. Llama 3.1 8B Fast üzerinde bu miktar, günde yaklaşık 280.000 çıktı token'ına karşılık geliyor. Cloudflare ayrıca ücretsiz görsel üretimi için FLUX barındırıyor. Bu da listedeki kredi kartı gerektirmeyen temel görsel üretim seçeneği.
Gizlilik konusunda listedeki en güçlü duruş Cloudflare'a ait. Şirket, izin alınmadığı sürece müşteri istemlerini veya çıktılarını eğitimde ya da hizmet geliştirmede kullanmayacağını açıkça taahhüt ediyor. Bu nedenle Workers AI, hassas verilerle çalışanlar için ilk öneri.
Neuron sistemi, ham istek veya token sayılarına kıyasla daha az anlaşılır. Belirli bir modelin token başına kaç Neuron tükettiğini görmek için Workers AI panosunu kontrol etmeniz gerekiyor.
Cohere, NVIDIA, Hugging Face ve Mistral
Cohere, ücretsiz katmanında dakikada 20 istek ve ayda 1.000 API çağrısı sunuyor. Bu limit operasyonel hacimden çok değerlendirme ve test çalışmaları için uygun. Cohere'ın Command modelleri ile embedding uç noktaları da pakete dahil.
NVIDIA NIM, kayıt sırasında 1.000 kredi veriyor; kurumsal e-posta kullanıldığında bu miktar 5.000'e kadar çıkıyor. Bunlar düzenli olarak yenilenen aylık bir hak değil, tek seferlik tüketilebilir krediler. Ayrıca kredinin kaç isteğe karşılık geldiğine dair yayımlanmış bir dönüşüm oranı bulunmuyor. OpenRouter'daki NVIDIA ücretsiz modellerinde ise önemli bir uyarı var: ücretsiz uç nokta kullanımı kayda alınıyor ve şirket gizli ya da kişisel verilerin gönderilmemesini öneriyor.
Hugging Face, Serverless Inference API üzerinden 200'den fazla modelde ayda yaklaşık $0,10 değerinde ücretsiz çıkarım kredisi sunuyor. Tahsis miktarının değişebileceği açıkça belirtiliyor. Bu yalnızca demo ölçeğinde bir hak: bir modeli denemeye yeter, üzerine ürün kurmaya değil.
Mistral, limitleri yalnızca Admin Panel içinde görülebilen ücretsiz bir API anahtarı modu sunuyor. Mistral dokümantasyonunda sıfır saklama seçeneğinden bahsediliyor; ancak bunun ücretsiz katmanda varsayılan ve net bir politika olduğu açıkça ifade edilmiyor. Bu da gizliliğin kritik olduğu kullanım senaryolarında değerlendirme yapmayı zorlaştırıyor.
Metnin ötesi: görsel, konuşma ve embedding
İki sağlayıcı metin dışındaki kullanım alanlarını da kapsıyor:
- Cloudflare Workers AI, görsel üretimi için FLUX'u ücretsiz barındırıyor. Bu listedeki tek kredi kartı gerektirmeyen seçenek. Gemini'nin görsel modelleri ücretsiz katmanda kullanılamıyor.
- Groq Whisper, ücretsiz planda günde 2.000 istek ve günlük 28.800 ses saniyesi sınırıyla konuşmayı metne dönüştürme özelliği sunuyor.
OpenRouter'ın ücretsiz kataloğu, NVIDIA'nın embedding ve yeniden sıralama modellerini de içerecek şekilde genişledi. Böylece ücretsiz katman arama, retrieval ve RAG senaryolarını da kapsıyor.
Veri önemliyse seçenekleriniz iki sağlayıcıya düşüyor
Hassas, kuruma özel veya mevzuata tabi verilerle çalışıyorsanız listedeki sağlayıcıların çoğunu elemeniz gerekiyor:
- Google AI Studio, ücretsiz katman istemlerini ürünlerini eğitmek için kullanıyor.
- NVIDIA, ücretsiz uç nokta kullanımını kayda alıyor ve gizli verilerin gönderilmemesi konusunda uyarıyor.
- OpenRouter, ücretsiz modellerde üst sağlayıcının veri politikasını devralıyor. Poolside ve Liquid gibi bazı sağlayıcılar ücretsiz istemlerle açıkça eğitim yapıyor.
- Hugging Face ve Mistral için saklama şartları ya belirsiz ya da değişebilir durumda.
Geriye gizlilik konusunda açık ve net taahhüt veren iki sağlayıcı kalıyor:
- Cloudflare Workers AI — izin olmadan eğitimde veya hizmet geliştirmede kullanmama yönünde açık taahhüt.
- Groq — varsayılan olarak çıkarım verisini saklamıyor; Zero Data Retention seçeneği mevcut.
İş yükünüz gizliliğe duyarlı ve düşük-orta hacimliyse daha güvenli seçim Cloudflare. Daha yüksek aktarım kapasitesine ihtiyacınız varsa ve Groq'un dakikadaki token limitleri içinde kalabiliyorsanız ZDR ile Groq iyi bir alternatif.
Ücretsiz katman ne zaman yetmemeye başlar?
Bu listedeki tüm ücretsiz katmanlar eninde sonunda sizi hız sınırlamasına sokacak. Asıl mesele, o noktada ne yapacağınız.
Önerilen yaklaşım, ücretsiz katmanlar arasında sürekli geçiş yapmak yerine tek bir sağlayıcıda ölçümlenen ücretli kullanıma geçmek. Limitleri aşmamak için sağlayıcı değiştirmek; farklı SDK'lar, farklı veri politikaları ve farklı hata senaryoları nedeniyle operasyonel karmaşıklık yaratıyor. Çoğu durumda bunun mühendislik maliyeti, API'den edilen tasarruftan daha yüksek.
Yukarıdaki sağlayıcılardan dördü OpenAI uyumlu uç noktaları destekliyor: Groq, OpenRouter, Cloudflare Workers AI ve Google AI Studio (OpenAI uyumlu wrapper üzerinden). Bu sayede uygulama kodunu baştan yazmadan yalnızca temel URL'yi ve API anahtarını değiştirerek bunlardan herhangi birinde ücretsiz kullanımdan ücretli kullanıma geçebilirsiniz.
Pratik geçiş planı şöyle: model çeşitliliği için Google AI Studio'da, yüksek aktarım kapasitesi için Groq'ta ücretsiz başlayın. Günlük limitlere düzenli olarak çarpmaya başladığınızda aynı sağlayıcıya bir faturalandırma hesabı ekleyip ölçümlenen ücretlendirmeye geçin. Birden fazla modeli test etmek için OpenRouter'ı, veri gizliliğinin pazarlık konusu olmadığı durumlarda ise Cloudflare'ı tercih edin.
Sık sorulan sorular
Hangi ücretsiz yapay zekâ API'si kredi kartı istemiyor? Yukarıda listelenen dokuz sağlayıcının tamamı kredi kartı olmadan API anahtarı veriyor: Google AI Studio, Groq, OpenRouter, GitHub Models, Cloudflare Workers AI, Cohere, NVIDIA, Hugging Face ve Mistral.
En yüksek günlük istek limitine sahip ücretsiz API hangisi? Groq, Llama 3.1 8B Instant için günde 14.400 istek sunuyor. Bu, burada listelenen sağlayıcılar arasındaki en yüksek yenilenen ücretsiz katman isteği.
OpenRouter gerçekten ücretsiz mi? OpenRouter'daki :free model varyantlarında token başına ücret alınmıyor; ancak günlük 50 istekle sınırlılar. $10 kredi satın alındığında bu limit 1.000 isteğe çıkıyor. BYOK modu, kendi sağlayıcı anahtarlarınız üzerinden yönlendirme yapmanıza ve plana göre belirlenen ücretsiz bir haktan yararlanmanıza izin veriyor. İki seçenek de gerçek anlamda sınırsız değil.
Ücretsiz bir yapay zekâ API'sini üretimde kullanabilir miyim? Hız limitleri dahilinde evet. Groq ve Cloudflare, güçlü oldukları alanlarda (sırasıyla aktarım kapasitesi ve gizlilik) üretime en hazır ücretsiz katmanları sunuyor. Ücretsiz limitler iş akışınızı düzenli olarak kesmeye başladığında aynı sağlayıcının ücretli katmanına geçin.
Gizliliğe duyarlı veriler için en iyi ücretsiz API hangisi? Cloudflare Workers AI ve Groq, ücretsiz katmanlarında eğitimde kullanmama ve saklamama konusunda açık taahhüt veren tek sağlayıcılar. Diğerleri ya ücretsiz istemlerle eğitim yapıyor (Google), kullanımı kayda alıyor (NVIDIA) ya da sağlayıcıya göre değişen politikalar uyguluyor (OpenRouter).