Una clave API gratuita para un LLM resulta muy útil para prototipos, scripts y comparativas de modelos. Pero que algo sea “gratis” no significa necesariamente que la cuota se renueve ni que sirva para producción.
Comprueba estas cuatro condiciones antes de registrarte
Antes de crear una cuenta, revisa estos cuatro posibles puntos de bloqueo:
| Qué comprobar | Qué debes verificar | Por qué importa |
|---|---|---|
| Tipo de acceso gratuito | Cuota recurrente, crédito de prueba o acceso promocional | Un crédito de un solo uso no equivale a una API gratuita permanente |
| Registro | Requisitos de correo, teléfono, tarjeta o región | El proceso puede detenerse antes de crear la clave |
| Datos y uso | Condiciones sobre entrenamiento, evaluación, uso comercial y reventa | Que sea gratis no anula las condiciones del proveedor |
| Interfaz | Endpoint compatible con OpenAI o API propia del proveedor | Una clave no garantiza compatibilidad con cualquier SDK |
Una cuota recurrente se renueva; un crédito de prueba se consume o caduca. Considera todas las cifras que aparecen a continuación como una fotografía fechada y confírmalas en el panel de límites actualizado del proveedor.
| Proveedor | Fricción durante el registro | Resumen del acceso gratuito | Tipo de API |
|---|---|---|---|
| Google AI Studio | Cuenta de Google; normalmente sin tarjeta | Las cuotas de Flash varían según el modelo; compruébalo en AI Studio | Propia del proveedor |
| Groq | Correo electrónico o SSO compatible | Habitualmente 30 RPM; los límites diarios varían según el modelo | Compatible con OpenAI |
| OpenRouter | Cuenta; no requiere tarjeta para las rutas gratuitas | Modelos :free rotatorios; los límites varían | Compatible con OpenAI |
| NVIDIA NIM | Cuenta de NVIDIA; puede requerir teléfono | Los límites de evaluación suelen rondar las 40 RPM | Compatible con OpenAI |
| Mistral | Correo y verificación de la cuenta | Créditos gratuitos compartidos entre productos | Compatible con OpenAI |
| Cloudflare Workers AI | Cuenta de Cloudflare | 10.000 Neurons al día en la asignación gratuita | Propia del proveedor |
| GitHub Models | Cuenta de GitHub | Cuota para prototipos que depende de la cuenta y del modelo | Propia de GitHub/con respaldo de Azure |
| Z.ai | Cuenta de desarrollador; la región puede influir | Algunos modelos Flash aparecen a 0 $; una solicitud simultánea | Compatible con OpenAI |
Los límites exactos pueden cambiar y el catálogo de modelos de un proveedor puede incluir opciones que no estén disponibles para tu cuenta.
Cuota recurrente o crédito de prueba
Google AI Studio, Groq, Cloudflare Workers AI y determinadas rutas de Z.ai ofrecen acceso continuado según la documentación citada de cada proveedor. El token de prueba de Cohere, el pequeño crédito de inferencia de Hugging Face y los saldos de bienvenida son otra cosa: se consumen.
Requisitos de tarjeta y teléfono
No pedir tarjeta no significa que no haya verificación. El registro de NVIDIA NIM puede incluir una verificación telefónica, y algunas cuentas de Mistral también solicitan confirmación por SMS. Google AI Studio y Groq suelen ser los puntos de partida con menos fricción, aunque los requisitos dependen de la cuenta y la región.
Uso de datos y restricciones comerciales
La documentación de facturación del nivel gratuito de Google y la documentación de precios de Mistral explican que las condiciones de uso de los datos pueden ser distintas de las del acceso de pago. Lee las condiciones vigentes del proveedor antes de enviar datos privados o de clientes.
Endpoint compatible con OpenAI o API propia del proveedor
Una URL base compatible con OpenAI facilita las primeras pruebas con SDK conocidos, pero la compatibilidad no implica un comportamiento idéntico. Los identificadores de modelo, el streaming, las llamadas a herramientas, los límites de contexto y los formatos de error pueden variar. Google AI Studio y Cloudflare Workers AI utilizan formatos de solicitud propios; Groq, OpenRouter, Mistral y otros proveedores documentan endpoints con estilo OpenAI.
Cómo registrarse en cada proveedor
Los enlaces siguientes llevan a consolas de proveedores o páginas oficiales para desarrolladores, no a repositorios de claves compartidas. Crea tu propia clave; nunca copies una publicada en un README, vídeo o comentario.
Google AI Studio: el punto de entrada multimodal más sencillo
Proceso de registro
- Abre Google AI Studio.
- Inicia sesión con una cuenta de Google.
- Entra en la sección de claves API y selecciona Create API key.
- Copia la clave una sola vez y guárdala en una variable de entorno.
La opción gratuita resulta especialmente útil para experimentar con entradas multimodales: Google documenta modelos Gemini capaces de trabajar con texto, imágenes, audio y vídeo, y algunas variantes Flash indicadas pueden ofrecer ventanas de contexto de hasta 1 millón de tokens. Google recomienda consultar el panel de cuotas de AI Studio porque los límites dependen del modelo y de la cuenta.
Elígelo primero si: necesitas contexto largo o entradas multimodales sin añadir una tarjeta. Ojo con: las condiciones actuales de uso de datos y las condiciones regionales del cliente API.
Groq: la vía más sencilla y rápida compatible con OpenAI
Proceso de registro
- Abre la Groq Console.
- Crea una cuenta o utiliza un sistema de inicio de sesión único compatible.
- Abre API Keys.
- Crea una clave y cópiala inmediatamente.
El endpoint documentado es https://api.groq.com/openai/v1. La documentación de límites de Groq recoge los límites de RPM y diarios para cada modelo; consulta esa página en lugar de fijar en el código una cifra sacada de un directorio antiguo. Groq ya ha retirado modelos anteriormente.
Elígelo primero si: quieres usar un SDK conocido de OpenAI y obtener respuestas rápidas durante la interacción. Ojo con: los cambios en los identificadores de modelo y los límites diarios específicos de cada uno.
OpenRouter: una sola clave para modelos gratuitos rotatorios
Proceso de registro
- Abre OpenRouter.
- Inicia sesión con una cuenta compatible.
- Abre la página Keys.
- Crea una clave y selecciona después un modelo marcado con el sufijo
:freeen el catálogo.
El endpoint de OpenRouter es https://openrouter.ai/api/v1. Una misma clave puede dar acceso a un conjunto cambiante de modelos de distintos proveedores, pero tanto la disponibilidad como el enrutamiento pueden variar. Consulta la documentación de límites antes de dar por hecho una cuota concreta.
Elígelo primero si: estás comparando modelos y puedes aceptar un catálogo que cambia. Ojo con: que desaparezca un modelo gratuito, las respuestas 403 por región y las reglas de la plataforma contra la reventa o la creación de un proxy competidor.
NVIDIA NIM: un catálogo amplio, con verificación telefónica
Proceso de registro
- Abre el catálogo de API de NVIDIA.
- Crea una cuenta de NVIDIA Developer o inicia sesión.
- Completa la verificación telefónica si se solicita.
- Abre la página de un modelo utilizable y selecciona Get API Key.
- Copia el identificador del modelo exactamente como aparece.
El endpoint documentado, con estilo OpenAI, es https://integrate.api.nvidia.com/v1. La vía gratuita de NVIDIA está pensada para evaluación, y la disponibilidad de los modelos puede variar entre el catálogo y los endpoints utilizables. Comprueba el límite actual en la página del modelo antes de integrarlo.
Elígelo primero si: necesitas probar muchos modelos de pesos abiertos. Ojo con: la verificación telefónica, la disponibilidad de los modelos y el límite de uso exclusivo para evaluación.
Mistral AI: una asignación amplia, pero con poco rendimiento
Proceso de registro
- Abre la consola para desarrolladores de Mistral.
- Crea una cuenta y completa las verificaciones solicitadas.
- Selecciona el modo de experimentación gratuita.
- Crea una clave API en la sección correspondiente.
El endpoint de Mistral es https://api.mistral.ai/v1. Mistral documenta créditos gratuitos compartidos entre sus productos y remite a la página Limits de la cuenta para consultar los valores actuales.
Elígelo primero si: necesitas modelos multilingües o de programación para un proyecto con poca concurrencia. Ojo con: los créditos compartidos, los límites de rendimiento y la configuración de uso de datos del modo gratuito.
Cloudflare Workers AI: asignación diaria de Neurons
Proceso de registro
- Crea una cuenta de Cloudflare.
- Abre Workers AI en el panel.
- Crea un token API con los permisos de Workers AI que muestra el panel.
- Utiliza tu ID de cuenta y el token con el endpoint de Workers AI.
La página de precios de Workers AI documenta una asignación gratuita diaria de 10.000 Neurons, compartida por toda la cuenta y restablecida a las 00:00 UTC. Las Neurons no son tokens: el modelo elegido modifica el consumo. Algunos modelos requieren un plan de pago de Workers.
Elígelo primero si: tu aplicación ya funciona en Cloudflare. Ojo con: la cuota compartida por toda la cuenta y una unidad de consumo que no equivale a tokens.
GitHub Models: práctico para prototipos, no como backend de producción gratuito
Proceso de registro
- Inicia sesión en GitHub Models.
- Elige un modelo o abre el playground.
- Crea el token de acceso personal de GitHub que indiquen las instrucciones actuales de Models, o utiliza la vía de acceso generada por el playground.
- Comprueba el límite actual del modelo antes de conectarlo a una aplicación.
El acceso a modelos de GitHub resulta cómodo para hacer pruebas, pero las cuotas gratuitas dependen de la cuenta y del modelo, y pueden ser reducidas. Considéralo una vía de desarrollo, no un acceso ilimitado a modelos premium.
Elígelo primero si: tu código y tus experimentos ya viven en GitHub. Ojo con: los límites que dependen de la cuenta y las restricciones propias de los prototipos.
Z.ai: acceso gratuito a GLM con una solicitud simultánea
Proceso de registro
- Abre la documentación de API de Z.ai.
- Regístrate en la plataforma para desarrolladores.
- Crea una clave en el centro de usuario.
- Selecciona un modelo Flash actual y utiliza el endpoint internacional si es adecuado para tu cuenta.
Entre los endpoints documentados están https://api.z.ai/api/paas/v4 y el regional https://open.bigmodel.cn/api/paas/v4. La página de precios de Z.ai muestra algunos modelos Flash con precio cero tanto para la entrada como para la salida; la ruta gratuita está limitada a una solicitud simultánea. Es suficiente para scripts secuenciales, pero no para agentes paralelos.
Elígelo primero si: necesitas trabajar en chino e inglés o quieres probar GLM. Ojo con: la concurrencia de una solicitud, las diferencias entre endpoints regionales y los avisos de retirada de modelos.
Prueba la clave sin exponerla
No pegues una clave en el código fuente ni en el historial del shell. Guárdala como variable de entorno y realiza después una única solicitud pequeña:
export LLM_API_KEY="paste-your-own-key-here"
curl https://api.groq.com/openai/v1/chat/completions \
-H "Authorization: Bearer $LLM_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "llama-3.3-70b-versatile",
"messages": [{"role":"user","content":"Reply with one word: ready"}],
"max_tokens": 8
}'
Cambia la URL base y el identificador del modelo cuando pruebes otro proveedor compatible con OpenAI. Si la respuesta falla:
- 401: falta la clave, está mal formada, revocada o se ha copiado con caracteres adicionales.
- 403: el modelo, la región, la cuenta o el caso de uso no están permitidos.
- 404: la URL base o el identificador del modelo son incorrectos.
- 429: has alcanzado un límite de solicitudes, tokens o concurrencia. Reduce el ritmo; no lances reintentos automáticos en un bucle demasiado ajustado.
Una prueba correcta demuestra que un modelo ha respondido una vez. No demuestra que las cuotas se renueven, que el uso en producción esté permitido ni que todos los modelos se comporten igual.
Elige según la carga de trabajo, no por la palabra “gratis”
| Tu situación | Empieza por | Motivo | Principal inconveniente |
|---|---|---|---|
| Primera prueba con una API | Google AI Studio | Registro rápido y modelos Flash multimodales | API propia del proveedor y condiciones de uso de datos |
| Prototipo con SDK de OpenAI | Groq | Endpoint conocido y velocidad interactiva | Los límites específicos del modelo pueden cambiar |
| Comparar muchos modelos | OpenRouter | Una clave y muchas rutas :free | Disponibilidad rotatoria y errores de los proveedores ascendentes |
| Probar un catálogo amplio de modelos abiertos | NVIDIA NIM | Muchos endpoints de evaluación | Verificación telefónica y condiciones de evaluación |
| Prueba multilingüe o de programación | Mistral | Familia de modelos amplia y asignación compartida | Baja tasa de solicitudes y créditos compartidos |
| Aplicación nativa de Cloudflare | Workers AI | Asignación diaria dentro de Cloudflare | Contabilidad por Neurons y cuota compartida por cuenta |
| Prototipo basado en GitHub | GitHub Models | Playground de modelos cómodo | Límites gratuitos reducidos o dependientes de la cuenta |
| Script secuencial en chino e inglés | Z.ai | Rutas gratuitas para GLM Flash | Una solicitud simultánea |
Cuándo deja de tener sentido usar una clave API gratuita
Una clave gratuita no encaja bien con un servicio de producción que necesite un SLA, un rendimiento predecible o garantías sobre los datos de los clientes. Tampoco es una buena opción para crear un proxy público: el proveedor puede prohibir la reventa del acceso y revocar una clave compartida sin previo aviso.
Crea tú mismo la clave, mantenla en el servidor, rótala si aparece en los registros y no utilices nunca una copiada de un repositorio público. Una clave pública puede estar ya agotada o comprometida, y usarla puede exponer tus prompts a un intermediario desconocido.
“Voy a matar a alguien; ¿por qué demonios anuncia la gente APIs gratuitas para LLM si luego no las ofrece de verdad y se limita a responder con un error de límite antes de que puedas enviar siquiera un prompt?” — @bunny3111039587, un usuario real hablando sobre el acceso gratuito a APIs de LLM.
Trata un endpoint gratuito como un experimento con un límite de seguridad, no como sustituto de una capacidad de pago.
Preguntas frecuentes sobre las claves API gratuitas para LLM
¿Puedo conseguir una clave API gratuita para un LLM sin tarjeta de crédito ni número de teléfono?
A menudo, sí. Google AI Studio, Groq y OpenRouter suelen documentarse como vías basadas en el correo electrónico, mientras que NVIDIA NIM y algunas cuentas de Mistral pueden solicitar verificación telefónica. Los requisitos dependen de la región y de la cuenta, así que comprueba la pantalla de registro actual.
¿Puedo conseguir una clave API gratuita para GPT?
Es posible obtener acceso gratuito a algunos modelos de la familia GPT mediante una plataforma alojada o un programa para desarrolladores, pero eso no equivale a tener una clave API de OpenAI permanentemente gratuita. Comprueba si se trata de una prueba, de un acceso exclusivo para prototipos o de una pasarela de terceros.
¿Puedo conseguir una clave API gratuita para Claude?
No des por hecho que existe una clave API de Claude propia, gratuita y disponible de forma general y permanente. Algunas pasarelas ofrecen rutas compatibles con Claude, pero pueden exigir créditos, aplicar condiciones distintas o utilizar un endpoint compatible con Anthropic.
¿Caducan las claves API gratuitas?
Las modalidades recurrentes pueden no tener una fecha de caducidad indicada, mientras que los créditos de prueba caducan o se agotan. Además, un proveedor puede revocar una clave, retirar un modelo, cambiar una cuota o eliminar una ruta gratuita. Anota cuándo comprobaste los límites del proveedor.
¿Puedo utilizar comercialmente una clave API gratuita para LLM?
No automáticamente. Las vías de prueba y evaluación pueden prohibir el uso en producción o con fines comerciales, y los proveedores de modelos pueden imponer restricciones adicionales. Lee las condiciones vigentes del proveedor y del modelo antes de lanzar una función comercial.
¿Qué debo hacer después de recibir un error 429?
Lee las cabeceras de la respuesta y el panel de cuotas. Después, reduce la concurrencia, añade una espera con retroceso exponencial, acorta las solicitudes o cambia a una alternativa permitida. No vayas rotando claves de otras personas ni bombardees el mismo endpoint.
La respuesta práctica a “¿qué LLM ofrece una clave API gratuita?” es empezar por Google AI Studio para trabajos multimodales, Groq para un prototipo con estilo OpenAI u OpenRouter para disponer de más modelos. Cuando el proyecto necesite un rendimiento predecible o prompts privados, toca pasar a capacidad de pago o autoalojada.