Uma chave de API gratuita para LLM resolve protótipos, scripts e comparações entre modelos. Mas “gratuita” nem sempre significa cota renovável ou uso seguro em produção.
Confira estas quatro condições antes de se cadastrar
Antes de criar a conta, vale checar quatro possíveis obstáculos:
| O que conferir | O que verificar | Por que isso importa |
|---|---|---|
| Tipo de acesso gratuito | Cota recorrente, crédito de teste ou acesso promocional | Um crédito único não é uma API gratuita permanente |
| Cadastro | Exigências de e-mail, telefone, cartão ou região | O processo pode travar antes mesmo da criação da chave |
| Dados e uso | Termos sobre treinamento, avaliação, uso comercial e revenda | “Gratuito” não substitui os termos do provedor |
| Interface | Endpoint compatível com OpenAI ou API nativa do provedor | Ter uma chave não garante compatibilidade com SDKs |
Uma cota recorrente é renovada; já um crédito de teste é consumido ou expira. Encare todos os números abaixo como um retrato datado e confirme os limites no painel atualizado do provedor.
| Provedor | Obstáculos no cadastro | Panorama do acesso gratuito | Estilo da API |
|---|---|---|---|
| Google AI Studio | Conta Google; geralmente sem cartão | Cotas do Flash variam por modelo; confira no AI Studio | Nativa do provedor |
| Groq | E-mail ou SSO compatível | Comumente 30 RPM; limites diários variam por modelo | Compatível com OpenAI |
| OpenRouter | Conta; sem cartão para rotas gratuitas | Modelos :free rotativos; limites variam | Compatível com OpenAI |
| NVIDIA NIM | Conta NVIDIA; telefone pode ser exigido | Limites de avaliação geralmente em torno de 40 RPM | Compatível com OpenAI |
| Mistral | E-mail e verificação da conta | Créditos gratuitos compartilhados entre produtos | Compatível com OpenAI |
| Cloudflare Workers AI | Conta Cloudflare | 10.000 Neurons/dia na cota gratuita | Nativa do provedor |
| GitHub Models | Conta GitHub | Cota para protótipos que depende da conta e do modelo | Nativa/Azure-backed |
| Z.ai | Conta de desenvolvedor; a região pode fazer diferença | Modelos Flash selecionados listados a $0; uma solicitação simultânea | Compatível com OpenAI |
Os limites exatos podem mudar, e o catálogo de modelos de um provedor pode incluir opções indisponíveis para a sua conta.
Cota recorrente ou crédito de teste
Google AI Studio, Groq, Cloudflare Workers AI e algumas rotas da Z.ai oferecem acesso contínuo segundo a documentação dos provedores citados. A chave de teste da Cohere, o pequeno crédito de inferência do Hugging Face e os saldos de cadastro são outra coisa: eles acabam.
Exigências de cartão e telefone
Não exigir cartão não significa dispensar verificações. O cadastro do NVIDIA NIM pode incluir confirmação por telefone; algumas contas da Mistral também pedem verificação por SMS. Google AI Studio e Groq costumam ser os pontos de partida com menos barreiras, mas os requisitos variam conforme a conta e a região.
Uso dos dados e restrições comerciais
A documentação de cobrança do nível gratuito do Google e a documentação de preços da Mistral explicam que as condições de uso dos dados podem ser diferentes no acesso pago. Leia os termos atuais do provedor antes de enviar dados privados ou de clientes.
Endpoint compatível com OpenAI ou API nativa do provedor
Uma URL base compatível com OpenAI facilita os primeiros testes com SDKs conhecidos, mas a compatibilidade não significa comportamento idêntico. IDs de modelo, streaming, chamadas de ferramentas, limites de contexto e formatos de erro ainda podem mudar. Google AI Studio e Cloudflare Workers AI usam formatos de requisição próprios; Groq, OpenRouter, Mistral e outros provedores oferecem endpoints no estilo OpenAI em sua documentação.
Como se cadastrar em cada provedor
Os links abaixo levam aos consoles dos provedores ou a páginas oficiais para desenvolvedores, não a repositórios de chaves compartilhadas. Crie a sua própria chave; nunca copie uma chave publicada em README, vídeo ou comentário.
Google AI Studio: a porta de entrada multimodal mais simples
Como se cadastrar
- Abra o Google AI Studio.
- Entre com uma conta Google.
- Abra a área de chaves de API e escolha Create API key.
- Copie a chave uma única vez e salve-a em uma variável de ambiente.
A rota gratuita é útil para experimentos multimodais: o Google documenta modelos Gemini com entrada de texto, imagem, áudio e vídeo, e as variantes Flash listadas podem ter janelas de contexto de até 1 milhão de tokens. O Google orienta os usuários a consultar o painel de cotas do AI Studio, pois os limites variam conforme o modelo e a conta.
Comece por aqui se: você precisa de contexto longo ou entrada multimodal sem adicionar um cartão. Fique atento a: termos atuais sobre uso de dados e clientes de API disponíveis na sua região.
Groq: o caminho mais simples para velocidade com compatibilidade OpenAI
Como se cadastrar
- Abra o Groq Console.
- Crie uma conta ou use um login único compatível.
- Abra API Keys.
- Crie uma chave e copie-a imediatamente.
O endpoint documentado é https://api.groq.com/openai/v1. A documentação de limites da Groq lista limites de RPM e diários específicos por modelo; consulte essa página em vez de fixar no código um número encontrado em um diretório antigo. A Groq já aposentou modelos anteriormente.
Comece por aqui se: você quer usar um SDK familiar da OpenAI e obter respostas rápidas em interações. Fique atento a: mudanças nos IDs dos modelos e nos limites diários de cada modelo.
OpenRouter: uma chave para modelos gratuitos rotativos
Como se cadastrar
- Abra o OpenRouter.
- Entre usando uma conta compatível.
- Abra a página Keys.
- Crie uma chave e selecione, no catálogo de modelos, uma opção marcada com o sufixo
:free.
O endpoint do OpenRouter é https://openrouter.ai/api/v1. Uma única chave pode acessar um conjunto variável de modelos de provedores upstream, mas a disponibilidade e o roteamento podem mudar. Consulte a documentação de limites antes de presumir uma quantidade de requisições.
Comece por aqui se: você está comparando modelos e aceita lidar com um catálogo rotativo. Fique atento a: um modelo gratuito desaparecer, respostas 403 por região e regras da plataforma contra revender acesso ou criar um proxy concorrente.
NVIDIA NIM: catálogo amplo, mas com verificação por telefone
Como se cadastrar
- Abra o catálogo de APIs da NVIDIA.
- Crie ou acesse uma conta NVIDIA Developer.
- Conclua a verificação por telefone, se solicitada.
- Abra a página de um modelo que possa ser chamado e escolha Get API Key.
- Copie o ID do modelo exatamente como ele aparece.
O endpoint documentado no estilo OpenAI é https://integrate.api.nvidia.com/v1. A rota gratuita da NVIDIA é voltada à avaliação, e a disponibilidade dos modelos pode ser diferente entre o catálogo e os endpoints que podem ser chamados. Confira o limite atual na página do modelo antes de integrá-lo.
Comece por aqui se: você precisa testar muitos modelos de pesos abertos. Fique atento a: verificação por telefone, disponibilidade dos modelos e à restrição de uso somente para avaliação.
Mistral AI: uma cota ampla, mas com baixa vazão
Como se cadastrar
- Abra o console de desenvolvedor da Mistral.
- Crie uma conta e conclua as verificações solicitadas.
- Selecione o modo de experimentação gratuita.
- Crie uma chave de API na seção de chaves.
O endpoint da Mistral é https://api.mistral.ai/v1. A Mistral documenta créditos gratuitos compartilhados entre seus produtos e orienta os usuários a consultar a página Limits da conta para ver os valores atuais.
Comece por aqui se: você precisa de modelos multilíngues ou de programação para um projeto com baixa concorrência. Fique atento a: créditos compartilhados, limites de vazão e à configuração de uso de dados do modo gratuito.
Cloudflare Workers AI: cota diária em Neurons
Como se cadastrar
- Crie uma conta Cloudflare.
- Abra Workers AI no painel.
- Crie um token de API com as permissões do Workers AI exibidas no painel.
- Use o ID da sua conta e o token com o endpoint do Workers AI.
A página de preços do Workers AI documenta uma cota gratuita diária de 10.000 Neurons, compartilhada por toda a conta e redefinida às 00:00 UTC. Neurons não são tokens: a escolha do modelo altera o consumo. Alguns modelos exigem um plano pago do Workers.
Comece por aqui se: sua aplicação já roda na Cloudflare. Fique atento a: cota compartilhada em toda a conta e à unidade de cobrança, que não é baseada em tokens.
GitHub Models: ótimo para protótipos, não para ser backend gratuito de produção
Como se cadastrar
- Entre no GitHub Models.
- Escolha um modelo ou abra o playground.
- Crie o token de acesso pessoal do GitHub exigido pelas instruções atuais do Models ou use o caminho de acesso gerado pelo playground.
- Confira o limite atual do modelo antes de conectá-lo a uma aplicação.
O acesso aos modelos do GitHub é conveniente para testes, mas as cotas gratuitas dependem da conta e do modelo e podem ser pequenas. Encare essa opção como uma rota de desenvolvimento, não como acesso ilimitado a modelos premium.
Comece por aqui se: seu código e seus experimentos já estão no GitHub. Fique atento a: limites que dependem da conta e restrições de uso em protótipos.
Z.ai: acesso gratuito ao GLM com uma requisição simultânea
Como se cadastrar
- Abra a documentação de API da Z.ai.
- Cadastre-se na plataforma para desenvolvedores.
- Crie uma chave no centro do usuário.
- Selecione um modelo Flash atual e use o endpoint internacional se ele for adequado à sua conta.
Os endpoints documentados incluem https://api.z.ai/api/paas/v4 e o endpoint regional https://open.bigmodel.cn/api/paas/v4. A página de preços da Z.ai lista modelos Flash selecionados com preço zero para entrada e saída; a rota gratuita é limitada a uma requisição simultânea. Isso funciona para scripts sequenciais, mas não para agentes paralelos.
Comece por aqui se: você precisa trabalhar em chinês e inglês ou quer testar o GLM. Fique atento a: uma requisição simultânea, diferenças entre endpoints regionais e avisos de aposentadoria de modelos.
Teste a chave sem expô-la
Não cole a chave no código-fonte nem no histórico do shell. Salve-a em uma variável de ambiente e faça uma única requisição pequena:
export LLM_API_KEY="paste-your-own-key-here"
curl https://api.groq.com/openai/v1/chat/completions \
-H "Authorization: Bearer $LLM_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "llama-3.3-70b-versatile",
"messages": [{"role":"user","content":"Reply with one word: ready"}],
"max_tokens": 8
}'
Troque a URL base e o ID do modelo para usar outro provedor compatível com OpenAI. Se a resposta falhar:
- 401: a chave está ausente, malformada, revogada ou foi copiada com caracteres extras.
- 403: o modelo, a região, a conta ou o caso de uso não é permitido.
- 404: a URL base ou o ID do modelo está errado.
- 429: você atingiu um limite de requisições, tokens ou concorrência. Diminua o ritmo; não dispare novas tentativas automáticas em um loop apertado.
Um teste bem-sucedido prova apenas que um modelo respondeu uma vez. Ele não confirma que as cotas serão renovadas, que o uso em produção é permitido ou que todos os modelos terão o mesmo comportamento.
Escolha pela carga de trabalho, não pela palavra “gratuito”
| Seu cenário | Comece com | Motivo | Principal concessão |
|---|---|---|---|
| Primeiro experimento com API | Google AI Studio | Cadastro rápido e modelos Flash multimodais | API nativa do provedor e condições de uso dos dados |
| Protótipo com SDK da OpenAI | Groq | Endpoint conhecido e velocidade interativa | Limites específicos por modelo podem mudar |
| Comparar muitos modelos | OpenRouter | Uma chave e várias rotas :free | Disponibilidade rotativa e erros dos provedores upstream |
| Testar um catálogo amplo de modelos abertos | NVIDIA NIM | Muitos endpoints de avaliação | Verificação por telefone e termos de avaliação |
| Teste multilíngue ou de programação | Mistral | Família ampla de modelos e cota compartilhada | Baixa taxa de requisições e créditos compartilhados |
| Aplicação nativa da Cloudflare | Workers AI | Cota diária dentro da Cloudflare | Contabilização por Neurons e cota compartilhada na conta |
| Protótipo baseado no GitHub | GitHub Models | Playground de modelos conveniente | Limites gratuitos pequenos ou dependentes da conta |
| Script sequencial em chinês e inglês | Z.ai | Rotas gratuitas do GLM Flash | Uma requisição simultânea |
Quando as chaves gratuitas deixam de fazer sentido
Uma chave gratuita não é uma boa escolha para um serviço de produção que precise de SLA, vazão previsível ou garantias sobre dados de clientes. Também não é adequada para um proxy público: o provedor pode proibir a revenda do acesso, e uma chave compartilhada pode ser revogada sem aviso.
Crie a chave você mesmo, mantenha-a no servidor, troque-a se ela aparecer em logs e nunca use uma chave copiada de um repositório público. Uma chave pública pode já estar esgotada ou comprometida, e utilizá-la pode expor seus prompts a um intermediário desconhecido.
“Vou matar alguém, por que diabos as pessoas anunciam APIs de LLM gratuitas se elas não oferecem isso de verdade e apenas respondem com um erro de limite antes mesmo de você conseguir enviar um prompt?” — @bunny3111039587, um usuário real comentando sobre o acesso a APIs gratuitas de LLM.
Trate um endpoint gratuito como um experimento com uma condição clara de parada, não como substituto para capacidade paga.
Perguntas frequentes sobre chaves de API gratuitas para LLM
Posso conseguir uma chave de API gratuita para LLM sem cartão de crédito ou número de telefone?
Frequentemente, sim. Google AI Studio, Groq e OpenRouter costumam ser documentados como opções baseadas em e-mail, enquanto NVIDIA NIM e algumas contas da Mistral podem solicitar verificação por telefone. Os requisitos variam conforme a região e a conta, então confira a tela de cadastro atual.
Posso conseguir uma chave de API gratuita para GPT?
Você pode obter acesso gratuito a alguns modelos da família GPT por meio de uma plataforma hospedada ou de um programa para desenvolvedores, mas isso não é o mesmo que ter uma chave de API da OpenAI permanentemente gratuita. Verifique se a rota oferece um teste, acesso exclusivo para protótipos ou um gateway de terceiros.
Posso conseguir uma chave de API gratuita para Claude?
Não presuma que exista uma chave de API do Claude de primeira parte, permanentemente gratuita e disponível de forma geral. Alguns gateways oferecem rotas compatíveis com Claude, mas podem exigir créditos, ter termos próprios ou usar um endpoint compatível com a Anthropic.
As chaves de API gratuitas expiram?
Os níveis recorrentes podem não ter uma data de expiração definida, enquanto créditos de teste expiram ou acabam. O provedor também pode revogar uma chave, aposentar um modelo, alterar uma cota ou remover uma rota gratuita. Registre quando você consultou os limites do provedor.
Posso usar comercialmente uma chave de API gratuita para LLM?
Não automaticamente. Rotas de teste e avaliação podem proibir o uso em produção ou comercial, e os provedores de modelos podem impor restrições adicionais. Leia os termos atuais do provedor e do modelo antes de lançar um recurso comercial.
O que devo fazer depois de receber um erro 429?
Leia os cabeçalhos da resposta e o painel de cotas. Em seguida, reduza a concorrência, adicione um recuo exponencial, encurte as requisições ou mude para um fallback permitido. Não alterne entre chaves de outras pessoas nem sobrecarregue o mesmo endpoint.
A resposta prática para “qual LLM oferece uma chave de API gratuita?” é começar pelo Google AI Studio para trabalho multimodal, pela Groq para um protótipo no estilo OpenAI ou pelo OpenRouter para ter mais opções de modelos. Quando o projeto precisar de vazão previsível ou prompts privados, passe para capacidade paga ou hospedada por você.