AIREITER
API-DOKSPREISE
VORLAGEN
  • AIReiter
  • Blog
  • Kostenloser LLM-API-Key: 8 Anmeldewege und Limits (2026)

Kostenloser LLM-API-Key: 8 Anmeldewege und Limits (2026)

Zuletzt aktualisiert: 2026-09-13 01:25:31

Ein kostenloser LLM-API-Key ist praktisch für Prototypen, Skripte und Modellvergleiche. „Kostenlos“ bedeutet aber nicht automatisch, dass das Kontingent regelmäßig erneuert wird oder sich der Dienst für den Produktionseinsatz eignet.

Diese vier Punkte sollten vor der Anmeldung geklärt sein

Bevor Sie sich registrieren, sollten Sie vier typische Stolpersteine prüfen:

PrüfpunktDas sollten Sie verifizierenWarum es wichtig ist
Art des kostenlosen ZugangsRegelmäßig erneuertes Kontingent, Testguthaben oder zeitlich begrenzte AktionEin einmaliges Guthaben ist keine dauerhaft kostenlose API
AnmeldungE-Mail, Telefonnummer, Kreditkarte oder regionale VoraussetzungenDie Registrierung kann noch vor der Erstellung des Keys scheitern
Daten und NutzungTraining, Evaluierung, kommerzielle Nutzung und Weiterverkauf„Kostenlos“ setzt die Anbieterbedingungen nicht außer Kraft
SchnittstelleOpenAI-kompatibler oder anbieterspezifischer EndpunktEin Key garantiert keine Kompatibilität mit jedem SDK

Ein wiederkehrendes Kontingent wird erneuert; ein Testguthaben wird verbraucht oder läuft ab. Betrachten Sie alle folgenden Zahlen als zeitgebundene Momentaufnahme und prüfen Sie sie im aktuellen Limit-Bereich des jeweiligen Anbieters.

AnbieterHürden bei der AnmeldungMomentaufnahme des kostenlosen ZugangsAPI-Stil
Google AI StudioGoogle-Konto; in der Regel keine KarteFlash-Kontingente variieren je nach Modell; in AI Studio prüfenAnbieterspezifisch
GroqE-Mail oder unterstütztes SSOÜblicherweise 30 RPM; Tageslimits variieren je nach ModellOpenAI-kompatibel
OpenRouterKonto; für kostenlose Routen keine KarteWechselnde :free-Modelle; Limits variierenOpenAI-kompatibel
NVIDIA NIMNVIDIA-Konto; Telefonnummer kann erforderlich seinEvaluierungslimits meist um 40 RPMOpenAI-kompatibel
MistralE-Mail und KontoverifizierungKostenlose Credits, die über mehrere Produkte geteilt werdenOpenAI-kompatibel
Cloudflare Workers AICloudflare-Konto10.000 Neurons/Tag im kostenlosen KontingentAnbieterspezifisch
GitHub ModelsGitHub-KontoVom Konto und Modell abhängiges Prototyping-KontingentAnbieterspezifisch/Azure-basiert
Z.aiEntwicklerkonto; Region kann entscheidend seinAusgewählte Flash-Modelle mit $0 gelistet; eine gleichzeitige AnfrageOpenAI-kompatibel

Konkrete Limits können sich ändern. Außerdem kann der Modellkatalog eines Anbieters Einträge enthalten, die für Ihr Konto nicht verfügbar sind.

Regelmäßig erneuertes Kontingent oder Testguthaben

Google AI Studio, Groq, Cloudflare Workers AI und ausgewählte Z.ai-Routen bieten laut der zitierten Anbieterdokumentation fortlaufenden Zugang. Ein Test-Key von Cohere, das kleine Inference-Guthaben von Hugging Face und Startguthaben funktionieren anders: Sie werden nach und nach aufgebraucht.

Anforderungen an Karte und Telefonnummer

Keine Kreditkarte bedeutet nicht zwingend, dass keinerlei Verifizierung nötig ist. Bei der Anmeldung für NVIDIA NIM kann eine Telefonverifizierung erforderlich sein; auch manche Mistral-Konten verlangen eine SMS-Bestätigung. Google AI Studio und Groq sind meist die unkomplizierteren Einstiege, allerdings unterscheiden sich die Anforderungen je nach Konto und Region.

Datennutzung und Einschränkungen für kommerzielle Projekte

Googles Dokumentation zur Abrechnung im kostenlosen Kontingent und Mistrals Preisdokumentation zeigen, dass die Bedingungen zur Datennutzung vom kostenpflichtigen Zugang abweichen können. Lesen Sie die aktuellen Anbieterbedingungen, bevor Sie private oder Kundendaten übertragen.

OpenAI-kompatibler Endpunkt oder native Anbieter-API

Eine OpenAI-kompatible Base-URL erleichtert erste Tests mit vertrauten SDKs. Vollständig identisch ist das Verhalten aber nicht. Modell-IDs, Streaming, Tool-Calling, Kontextlimits und Fehlerformate können weiterhin abweichen. Google AI Studio und Cloudflare Workers AI verwenden anbieterspezifische Anfrageformate; Groq, OpenRouter, Mistral und weitere Anbieter dokumentieren OpenAI-kompatible Endpunkte.

Anmeldewege der einzelnen Anbieter

Die folgenden Links führen zu den Konsolen oder offiziellen Entwicklerseiten der Anbieter – nicht zu Sammlungen geteilter Keys. Erstellen Sie Ihren eigenen Key und kopieren Sie niemals einen Schlüssel aus einem README, Video oder Kommentar.

Google AI Studio: der einfachste Einstieg für multimodale Tests

Anmeldeweg

  1. Öffnen Sie Google AI Studio.
  2. Melden Sie sich mit einem Google-Konto an.
  3. Öffnen Sie den Bereich für API-Keys und wählen Sie Create API key.
  4. Kopieren Sie den Key einmalig und speichern Sie ihn in einer Umgebungsvariable.

Der kostenlose Zugang eignet sich gut für multimodale Experimente: Google dokumentiert Gemini-Modelle mit Text-, Bild-, Audio- und Videoeingabe. Die aufgeführten Flash-Varianten können Kontextfenster von bis zu 1 Million Tokens bieten. Für die aktuellen Limits verweist Google auf den Kontingentbereich in AI Studio, da sie je nach Modell und Konto variieren.

Besonders geeignet, wenn: Sie langen Kontext oder multimodale Eingaben benötigen, ohne eine Karte zu hinterlegen. Darauf achten: aktuelle Bedingungen zur Datennutzung und regionale Vorgaben für API-Clients.

Groq: der unkomplizierteste schnelle OpenAI-kompatible Weg

Anmeldeweg

  1. Öffnen Sie die Groq Console.
  2. Erstellen Sie ein Konto oder nutzen Sie ein unterstütztes Single-Sign-on-Verfahren.
  3. Öffnen Sie API Keys.
  4. Erstellen Sie einen Key und kopieren Sie ihn sofort.

Der dokumentierte Endpunkt lautet https://api.groq.com/openai/v1. Groqs Dokumentation zu Rate Limits führt modellabhängige RPM- und Tageslimits auf. Prüfen Sie diese Seite, statt eine Zahl aus einem veralteten Verzeichnis fest zu hinterlegen. Groq hat in der Vergangenheit Modelle eingestellt.

Besonders geeignet, wenn: Sie ein vertrautes OpenAI-SDK und schnelle Antworten für interaktive Anwendungen möchten. Darauf achten: wechselnde Modell-IDs und Tageslimits pro Modell.

OpenRouter: ein Key für wechselnde kostenlose Modelle

Anmeldeweg

  1. Öffnen Sie OpenRouter.
  2. Melden Sie sich mit einem unterstützten Konto an.
  3. Öffnen Sie die Seite Keys.
  4. Erstellen Sie einen Key und wählen Sie anschließend im Modellkatalog ein Modell mit dem Suffix :free.

OpenRouters Endpunkt lautet https://openrouter.ai/api/v1. Mit einem Key lässt sich eine wechselnde Auswahl vorgeschalteter Modelle erreichen, wobei sich Verfügbarkeit und Routing ändern können. Prüfen Sie die Dokumentation zu den Limits, bevor Sie von einem bestimmten Anfragekontingent ausgehen.

Besonders geeignet, wenn: Sie Modelle vergleichen und mit einem wechselnden Katalog leben können. Darauf achten: dass ein kostenloses Modell verschwinden kann, regionale 403-Antworten auftreten und Plattformregeln den Weiterverkauf oder den Aufbau eines konkurrierenden Proxys untersagen können.

NVIDIA NIM: großer Katalog, Telefonverifizierung

Anmeldeweg

  1. Öffnen Sie den API-Katalog von NVIDIA.
  2. Erstellen Sie ein NVIDIA-Developer-Konto oder melden Sie sich an.
  3. Schließen Sie die Telefonverifizierung ab, falls sie verlangt wird.
  4. Öffnen Sie die Seite eines aufrufbaren Modells und wählen Sie Get API Key.
  5. Übernehmen Sie die Modell-ID exakt so, wie sie angezeigt wird.

Der dokumentierte OpenAI-kompatible Endpunkt lautet https://integrate.api.nvidia.com/v1. Der kostenlose Zugang von NVIDIA ist für Evaluierungen gedacht. Außerdem kann sich die Verfügbarkeit eines Modells zwischen Katalog und tatsächlich aufrufbaren Endpunkten unterscheiden. Prüfen Sie das aktuelle Limit direkt auf der Modellseite, bevor Sie eine Integration bauen.

Besonders geeignet, wenn: Sie viele Open-Weight-Modelle ausprobieren möchten. Darauf achten: Telefonverifizierung, Modellverfügbarkeit und die Beschränkung auf Evaluierungszwecke.

Mistral AI: großzügiges Kontingent bei niedriger Geschwindigkeit

Anmeldeweg

  1. Öffnen Sie die Mistral-Entwicklerkonsole.
  2. Erstellen Sie ein Konto und schließen Sie angeforderte Verifizierungen ab.
  3. Wählen Sie den kostenlosen Experimentiermodus.
  4. Erstellen Sie im Bereich für API-Keys einen Schlüssel.

Mistrals Endpunkt lautet https://api.mistral.ai/v1. Mistral dokumentiert kostenlose Credits, die über mehrere Produkte hinweg geteilt werden, und verweist für die aktuellen Werte auf die Limits-Seite des Kontos.

Besonders geeignet, wenn: Sie mehrsprachige oder Coding-Modelle für ein Projekt mit geringer Parallelität benötigen. Darauf achten: geteilte Credits, Durchsatzlimits und die Einstellung zur Datennutzung im kostenlosen Modus.

Cloudflare Workers AI: tägliches Neurons-Kontingent

Anmeldeweg

  1. Erstellen Sie ein Cloudflare-Konto.
  2. Öffnen Sie Workers AI im Dashboard.
  3. Erstellen Sie ein API-Token mit den im Dashboard angezeigten Workers-AI-Berechtigungen.
  4. Verwenden Sie Ihre Konto-ID und das Token mit dem Workers-AI-Endpunkt.

Die Preisseite von Workers AI dokumentiert ein kostenloses Tageskontingent von 10.000 Neurons, das über das gesamte Konto geteilt und um 00:00 UTC zurückgesetzt wird. Neurons sind keine Tokens: Die Modellauswahl beeinflusst den Verbrauch. Für manche Modelle ist ein kostenpflichtiger Workers-Tarif erforderlich.

Besonders geeignet, wenn: Ihre Anwendung bereits auf Cloudflare läuft. Darauf achten: das kontoübergreifend geteilte Kontingent und die Abrechnungseinheit, die nicht auf Tokens basiert.

GitHub Models: praktisch für Prototypen, kein kostenloses Produktions-Backend

Anmeldeweg

  1. Melden Sie sich bei GitHub Models an.
  2. Wählen Sie ein Modell oder öffnen Sie den Playground.
  3. Erstellen Sie das von den aktuellen Models-Anweisungen verlangte persönliche GitHub-Access-Token oder verwenden Sie den vom Playground erzeugten Zugangsweg.
  4. Prüfen Sie das aktuelle Rate Limit des Modells, bevor Sie es in eine Anwendung integrieren.

Der Modellzugang von GitHub ist für Tests sehr praktisch. Die kostenlosen Kontingente hängen jedoch vom Konto und vom Modell ab und können klein ausfallen. Betrachten Sie GitHub Models als Entwicklungsweg und nicht als unbegrenzten Zugang zu Premium-Modellen.

Besonders geeignet, wenn: Ihr Code und Ihre Experimente ohnehin in GitHub liegen. Darauf achten: kontenabhängige Limits und Einschränkungen auf Prototypen.

Z.ai: kostenloser GLM-Zugang mit nur einer parallelen Anfrage

Anmeldeweg

  1. Öffnen Sie die API-Dokumentation von Z.ai.
  2. Registrieren Sie sich für die Entwicklerplattform.
  3. Erstellen Sie im Benutzerbereich einen Key.
  4. Wählen Sie ein aktuelles Flash-Modell und verwenden Sie den internationalen Endpunkt, sofern er für Ihr Konto geeignet ist.

Zu den dokumentierten Endpunkten gehören https://api.z.ai/api/paas/v4 und der regionale Endpunkt https://open.bigmodel.cn/api/paas/v4. Auf der Preisseite von Z.ai sind ausgewählte Flash-Modelle mit einem Eingabe- und Ausgabepreis von null gelistet; der kostenlose Zugang ist auf eine parallele Anfrage begrenzt. Das passt zu sequenziellen Skripten, nicht aber zu parallel arbeitenden Agenten.

Besonders geeignet, wenn: Sie chinesische und englische Inhalte verarbeiten oder GLM testen möchten. Darauf achten: die Begrenzung auf eine parallele Anfrage, regionale Unterschiede bei den Endpunkten und Hinweise auf auslaufende Modelle.

Den Key testen, ohne ihn preiszugeben

Fügen Sie einen Key weder in den Quellcode noch in die Shell-History ein. Speichern Sie ihn als Umgebungsvariable und senden Sie anschließend eine kleine Testanfrage:

export LLM_API_KEY="paste-your-own-key-here"

curl https://api.groq.com/openai/v1/chat/completions \
  -H "Authorization: Bearer $LLM_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "llama-3.3-70b-versatile",
    "messages": [{"role":"user","content":"Reply with one word: ready"}],
    "max_tokens": 8
  }'

Für einen anderen OpenAI-kompatiblen Anbieter ersetzen Sie Base-URL und Modell-ID. Falls die Antwort fehlschlägt:

  1. 401: Der Key fehlt, ist falsch formatiert, widerrufen oder wurde mit zusätzlichen Zeichen kopiert.
  2. 403: Modell, Region, Konto oder Anwendungsfall sind nicht freigegeben.
  3. 404: Base-URL oder Modell-ID sind falsch.
  4. 429: Sie haben ein Anfrage-, Token- oder Parallelitätslimit erreicht. Drosseln Sie die Anfragen und starten Sie keine automatischen Retries in einer engen Endlosschleife.

Ein erfolgreicher Test zeigt nur, dass ein Modell einmal geantwortet hat. Er beweist weder, dass sich Kontingente erneuern, noch dass der Einsatz in der Produktion erlaubt ist oder sich alle Modelle gleich verhalten.

Nach dem Einsatz entscheiden – nicht nach dem Wort „kostenlos“

Ihre SituationStartpunktGrundWichtigster Kompromiss
Erster API-TestGoogle AI StudioSchnelle Anmeldung und multimodale Flash-ModelleAnbieterspezifische API und Bedingungen zur Datennutzung
OpenAI-SDK-PrototypGroqVertrauter Endpunkt und interaktive GeschwindigkeitLimits pro Modell können sich ändern
Viele Modelle vergleichenOpenRouterEin Key und viele :free-RoutenWechselnde Verfügbarkeit und Fehler der vorgeschalteten Anbieter
Großen Katalog offener Modelle testenNVIDIA NIMZahlreiche Evaluierungs-EndpunkteTelefonverifizierung und Evaluierungsbedingungen
Mehrsprachiger oder Coding-TestMistralBreite Modellfamilie und gemeinsames KontingentNiedrige Anfragerate und geteilte Credits
Cloudflare-native AnwendungWorkers AITägliches Kontingent innerhalb von CloudflareAbrechnung in Neurons und kontoübergreifendes Kontingent
GitHub-basierter PrototypGitHub ModelsPraktischer Modell-PlaygroundKleine oder kontenabhängige kostenlose Limits
Sequenzielles chinesisch-englisches SkriptZ.aiKostenlose GLM-Flash-RoutenEine parallele Anfrage

Wann kostenlose API-Keys keine gute Wahl mehr sind

Für einen Produktionsdienst mit SLA, planbarem Durchsatz oder verbindlichen Garantien für Kundendaten ist ein kostenloser Key meist ungeeignet. Auch als öffentlicher Proxy taugt er schlecht: Ein Anbieter kann den Weiterverkauf des Zugangs untersagen, und ein geteilter Key kann jederzeit ohne Vorwarnung widerrufen werden.

Erstellen Sie den Key selbst, halten Sie ihn auf dem Server und tauschen Sie ihn aus, sobald er in Logs auftaucht. Verwenden Sie niemals einen Schlüssel aus einem öffentlichen Repository. Ein veröffentlichter Key kann bereits aufgebraucht oder kompromittiert sein; außerdem könnten Prompts dabei an einen unbekannten Zwischenanbieter gelangen.

„I'm gonna kill someone why TF do people advertise free llm api only to not actually provide it and instead just respond with rate limit error before you can even send one prompt?“ — @bunny3111039587, ein echter Nutzer über den Zugang zu kostenlosen LLM-APIs.

Behandeln Sie einen kostenlosen Endpunkt als Experiment mit klarer Abbruchbedingung – nicht als Ersatz für bezahlbare, planbare Kapazität.

FAQ zu kostenlosen LLM-API-Keys

Kann ich einen kostenlosen LLM-API-Key ohne Kreditkarte oder Telefonnummer bekommen?

Oft ja. Google AI Studio, Groq und OpenRouter werden üblicherweise als E-Mail-basierte Zugänge dokumentiert, während NVIDIA NIM und manche Mistral-Konten eine Telefonverifizierung verlangen können. Die Anforderungen unterscheiden sich je nach Region und Konto – prüfen Sie daher die aktuelle Anmeldemaske.

Kann ich einen kostenlosen GPT-API-Key bekommen?

Über eine gehostete Plattform oder ein Entwicklerprogramm können Sie möglicherweise kostenlos auf einige Modelle der GPT-Familie zugreifen. Das ist jedoch nicht dasselbe wie ein dauerhaft kostenloser OpenAI-API-Key. Prüfen Sie, ob es sich um einen Testzugang, einen reinen Prototyping-Zugang oder ein Gateway eines Drittanbieters handelt.

Kann ich einen kostenlosen Claude-API-Key bekommen?

Gehen Sie nicht von einem allgemein verfügbaren, dauerhaft kostenlosen Claude-API-Key aus erster Hand aus. Manche Gateways bieten Claude-kompatible Routen an, verlangen dafür aber möglicherweise Credits, gelten eigenen Bedingungen oder verwenden einen Anthropic-kompatiblen Endpunkt.

Laufen kostenlose API-Keys ab?

Für wiederkehrende Tarife gibt es möglicherweise kein ausdrücklich genanntes Ablaufdatum, während Testguthaben ablaufen oder aufgebraucht werden. Ein Anbieter kann außerdem einen Key widerrufen, ein Modell einstellen, ein Kontingent ändern oder eine kostenlose Route entfernen. Notieren Sie, wann Sie die Limits des Anbieters geprüft haben.

Darf ich einen kostenlosen LLM-API-Key kommerziell nutzen?

Nicht automatisch. Test- und Evaluierungszugänge können den Einsatz in Produktion oder für kommerzielle Zwecke untersagen. Zusätzlich können die Modellanbieter weitere Einschränkungen vorgeben. Lesen Sie die aktuellen Bedingungen des Anbieters und des jeweiligen Modells, bevor Sie eine kommerzielle Funktion veröffentlichen.

Was sollte ich nach einem 429-Fehler tun?

Prüfen Sie die Antwort-Header und das Kontingent im Dashboard. Reduzieren Sie anschließend die Parallelität, ergänzen Sie exponentielles Backoff, kürzen Sie die Anfragen oder wechseln Sie zu einem zulässigen Fallback. Wechseln Sie nicht auf die Keys anderer Personen und bombardieren Sie nicht denselben Endpunkt.

Die praktische Antwort auf die Frage „Welcher LLM bietet einen kostenlosen API-Key?“ lautet: Starten Sie für multimodale Aufgaben mit Google AI Studio, für einen OpenAI-kompatiblen Prototyp mit Groq oder für eine große Modellauswahl mit OpenRouter. Sobald das Projekt planbaren Durchsatz oder private Prompts benötigt, führt der Weg zu kostenpflichtiger oder selbst gehosteter Kapazität.

>_AIReiter Modellverzeichnis

Schneller API-Zugriff auf Modelle zu diesem Guide

Claude Opus 5

Chat

Ein Premium-Model von Claude für komplexes Schlussfolgern, Programmierung und professionelle Arbeit mit langem Kontext.

AnthropicAPI-Key erstellen >

Gemini 3.8 Flash

Chat

Long-context Flash model for coding, agents, and enterprise workflows.

GoogleAPI-Key erstellen >

DeepSeek V4 Pro

Chat

DeepSeek V4 Pro für tiefes Code-Reasoning, Architekturplanung und technische Analyse.

DeepseekAPI-Key erstellen >

Claude Fable 5

Chat

Ein Premium-Claude-Modell für tiefes Denken und komplexe Arbeiten über längere Formate.

AnthropicAPI-Key erstellen >

Claude Fable 5.1

Chat

Mythos-class model for long-horizon coding, research, and knowledge work.

AnthropicAPI-Key erstellen >

Neueste Beiträge

Suno v6 vs. v6-wild vs. v6-mini: Der Genre- und Workflow-Guide

2026-09-12

Suno v6: Kommerzielle Nutzung und Urheberrecht – welche Risiken für Creator bleiben

2026-09-12

Suno-v6-Test: Upgrade oder erzwungener Umstieg? (2026)

2026-09-12

OpenRouter Fusion Flash API: Status, Einrichtung und Lösungen für 400-Fehler

2026-09-11
AIREITER

Fragen? Kontaktieren Sie uns unter
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

KI-Video

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

KI-Bild

GPT-Image 2.5Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image Turbo

Blog

Alle anzeigen →

Unternehmen

DatenschutzrichtlinieNutzungsbedingungenRückerstattungsrichtlinie

© 2026 AIReiter. Alle Rechte vorbehalten.