AIREITER
DOCS APIPREÇOS
TEMPLATES
  • AIReiter
  • Blog
  • Chave de API gratuita para LLM: 8 caminhos de cadastro e limites (2026)

Chave de API gratuita para LLM: 8 caminhos de cadastro e limites (2026)

Última Atualização: 2026-09-13 01:27:16

Uma chave de API gratuita para LLM resolve protótipos, scripts e comparações entre modelos. Mas “gratuita” nem sempre significa cota renovável ou uso seguro em produção.

Confira estas quatro condições antes de se cadastrar

Antes de criar a conta, vale checar quatro possíveis obstáculos:

O que conferirO que verificarPor que isso importa
Tipo de acesso gratuitoCota recorrente, crédito de teste ou acesso promocionalUm crédito único não é uma API gratuita permanente
CadastroExigências de e-mail, telefone, cartão ou regiãoO processo pode travar antes mesmo da criação da chave
Dados e usoTermos sobre treinamento, avaliação, uso comercial e revenda“Gratuito” não substitui os termos do provedor
InterfaceEndpoint compatível com OpenAI ou API nativa do provedorTer uma chave não garante compatibilidade com SDKs

Uma cota recorrente é renovada; já um crédito de teste é consumido ou expira. Encare todos os números abaixo como um retrato datado e confirme os limites no painel atualizado do provedor.

ProvedorObstáculos no cadastroPanorama do acesso gratuitoEstilo da API
Google AI StudioConta Google; geralmente sem cartãoCotas do Flash variam por modelo; confira no AI StudioNativa do provedor
GroqE-mail ou SSO compatívelComumente 30 RPM; limites diários variam por modeloCompatível com OpenAI
OpenRouterConta; sem cartão para rotas gratuitasModelos :free rotativos; limites variamCompatível com OpenAI
NVIDIA NIMConta NVIDIA; telefone pode ser exigidoLimites de avaliação geralmente em torno de 40 RPMCompatível com OpenAI
MistralE-mail e verificação da contaCréditos gratuitos compartilhados entre produtosCompatível com OpenAI
Cloudflare Workers AIConta Cloudflare10.000 Neurons/dia na cota gratuitaNativa do provedor
GitHub ModelsConta GitHubCota para protótipos que depende da conta e do modeloNativa/Azure-backed
Z.aiConta de desenvolvedor; a região pode fazer diferençaModelos Flash selecionados listados a $0; uma solicitação simultâneaCompatível com OpenAI

Os limites exatos podem mudar, e o catálogo de modelos de um provedor pode incluir opções indisponíveis para a sua conta.

Cota recorrente ou crédito de teste

Google AI Studio, Groq, Cloudflare Workers AI e algumas rotas da Z.ai oferecem acesso contínuo segundo a documentação dos provedores citados. A chave de teste da Cohere, o pequeno crédito de inferência do Hugging Face e os saldos de cadastro são outra coisa: eles acabam.

Exigências de cartão e telefone

Não exigir cartão não significa dispensar verificações. O cadastro do NVIDIA NIM pode incluir confirmação por telefone; algumas contas da Mistral também pedem verificação por SMS. Google AI Studio e Groq costumam ser os pontos de partida com menos barreiras, mas os requisitos variam conforme a conta e a região.

Uso dos dados e restrições comerciais

A documentação de cobrança do nível gratuito do Google e a documentação de preços da Mistral explicam que as condições de uso dos dados podem ser diferentes no acesso pago. Leia os termos atuais do provedor antes de enviar dados privados ou de clientes.

Endpoint compatível com OpenAI ou API nativa do provedor

Uma URL base compatível com OpenAI facilita os primeiros testes com SDKs conhecidos, mas a compatibilidade não significa comportamento idêntico. IDs de modelo, streaming, chamadas de ferramentas, limites de contexto e formatos de erro ainda podem mudar. Google AI Studio e Cloudflare Workers AI usam formatos de requisição próprios; Groq, OpenRouter, Mistral e outros provedores oferecem endpoints no estilo OpenAI em sua documentação.

Como se cadastrar em cada provedor

Os links abaixo levam aos consoles dos provedores ou a páginas oficiais para desenvolvedores, não a repositórios de chaves compartilhadas. Crie a sua própria chave; nunca copie uma chave publicada em README, vídeo ou comentário.

Google AI Studio: a porta de entrada multimodal mais simples

Como se cadastrar

  1. Abra o Google AI Studio.
  2. Entre com uma conta Google.
  3. Abra a área de chaves de API e escolha Create API key.
  4. Copie a chave uma única vez e salve-a em uma variável de ambiente.

A rota gratuita é útil para experimentos multimodais: o Google documenta modelos Gemini com entrada de texto, imagem, áudio e vídeo, e as variantes Flash listadas podem ter janelas de contexto de até 1 milhão de tokens. O Google orienta os usuários a consultar o painel de cotas do AI Studio, pois os limites variam conforme o modelo e a conta.

Comece por aqui se: você precisa de contexto longo ou entrada multimodal sem adicionar um cartão. Fique atento a: termos atuais sobre uso de dados e clientes de API disponíveis na sua região.

Groq: o caminho mais simples para velocidade com compatibilidade OpenAI

Como se cadastrar

  1. Abra o Groq Console.
  2. Crie uma conta ou use um login único compatível.
  3. Abra API Keys.
  4. Crie uma chave e copie-a imediatamente.

O endpoint documentado é https://api.groq.com/openai/v1. A documentação de limites da Groq lista limites de RPM e diários específicos por modelo; consulte essa página em vez de fixar no código um número encontrado em um diretório antigo. A Groq já aposentou modelos anteriormente.

Comece por aqui se: você quer usar um SDK familiar da OpenAI e obter respostas rápidas em interações. Fique atento a: mudanças nos IDs dos modelos e nos limites diários de cada modelo.

OpenRouter: uma chave para modelos gratuitos rotativos

Como se cadastrar

  1. Abra o OpenRouter.
  2. Entre usando uma conta compatível.
  3. Abra a página Keys.
  4. Crie uma chave e selecione, no catálogo de modelos, uma opção marcada com o sufixo :free.

O endpoint do OpenRouter é https://openrouter.ai/api/v1. Uma única chave pode acessar um conjunto variável de modelos de provedores upstream, mas a disponibilidade e o roteamento podem mudar. Consulte a documentação de limites antes de presumir uma quantidade de requisições.

Comece por aqui se: você está comparando modelos e aceita lidar com um catálogo rotativo. Fique atento a: um modelo gratuito desaparecer, respostas 403 por região e regras da plataforma contra revender acesso ou criar um proxy concorrente.

NVIDIA NIM: catálogo amplo, mas com verificação por telefone

Como se cadastrar

  1. Abra o catálogo de APIs da NVIDIA.
  2. Crie ou acesse uma conta NVIDIA Developer.
  3. Conclua a verificação por telefone, se solicitada.
  4. Abra a página de um modelo que possa ser chamado e escolha Get API Key.
  5. Copie o ID do modelo exatamente como ele aparece.

O endpoint documentado no estilo OpenAI é https://integrate.api.nvidia.com/v1. A rota gratuita da NVIDIA é voltada à avaliação, e a disponibilidade dos modelos pode ser diferente entre o catálogo e os endpoints que podem ser chamados. Confira o limite atual na página do modelo antes de integrá-lo.

Comece por aqui se: você precisa testar muitos modelos de pesos abertos. Fique atento a: verificação por telefone, disponibilidade dos modelos e à restrição de uso somente para avaliação.

Mistral AI: uma cota ampla, mas com baixa vazão

Como se cadastrar

  1. Abra o console de desenvolvedor da Mistral.
  2. Crie uma conta e conclua as verificações solicitadas.
  3. Selecione o modo de experimentação gratuita.
  4. Crie uma chave de API na seção de chaves.

O endpoint da Mistral é https://api.mistral.ai/v1. A Mistral documenta créditos gratuitos compartilhados entre seus produtos e orienta os usuários a consultar a página Limits da conta para ver os valores atuais.

Comece por aqui se: você precisa de modelos multilíngues ou de programação para um projeto com baixa concorrência. Fique atento a: créditos compartilhados, limites de vazão e à configuração de uso de dados do modo gratuito.

Cloudflare Workers AI: cota diária em Neurons

Como se cadastrar

  1. Crie uma conta Cloudflare.
  2. Abra Workers AI no painel.
  3. Crie um token de API com as permissões do Workers AI exibidas no painel.
  4. Use o ID da sua conta e o token com o endpoint do Workers AI.

A página de preços do Workers AI documenta uma cota gratuita diária de 10.000 Neurons, compartilhada por toda a conta e redefinida às 00:00 UTC. Neurons não são tokens: a escolha do modelo altera o consumo. Alguns modelos exigem um plano pago do Workers.

Comece por aqui se: sua aplicação já roda na Cloudflare. Fique atento a: cota compartilhada em toda a conta e à unidade de cobrança, que não é baseada em tokens.

GitHub Models: ótimo para protótipos, não para ser backend gratuito de produção

Como se cadastrar

  1. Entre no GitHub Models.
  2. Escolha um modelo ou abra o playground.
  3. Crie o token de acesso pessoal do GitHub exigido pelas instruções atuais do Models ou use o caminho de acesso gerado pelo playground.
  4. Confira o limite atual do modelo antes de conectá-lo a uma aplicação.

O acesso aos modelos do GitHub é conveniente para testes, mas as cotas gratuitas dependem da conta e do modelo e podem ser pequenas. Encare essa opção como uma rota de desenvolvimento, não como acesso ilimitado a modelos premium.

Comece por aqui se: seu código e seus experimentos já estão no GitHub. Fique atento a: limites que dependem da conta e restrições de uso em protótipos.

Z.ai: acesso gratuito ao GLM com uma requisição simultânea

Como se cadastrar

  1. Abra a documentação de API da Z.ai.
  2. Cadastre-se na plataforma para desenvolvedores.
  3. Crie uma chave no centro do usuário.
  4. Selecione um modelo Flash atual e use o endpoint internacional se ele for adequado à sua conta.

Os endpoints documentados incluem https://api.z.ai/api/paas/v4 e o endpoint regional https://open.bigmodel.cn/api/paas/v4. A página de preços da Z.ai lista modelos Flash selecionados com preço zero para entrada e saída; a rota gratuita é limitada a uma requisição simultânea. Isso funciona para scripts sequenciais, mas não para agentes paralelos.

Comece por aqui se: você precisa trabalhar em chinês e inglês ou quer testar o GLM. Fique atento a: uma requisição simultânea, diferenças entre endpoints regionais e avisos de aposentadoria de modelos.

Teste a chave sem expô-la

Não cole a chave no código-fonte nem no histórico do shell. Salve-a em uma variável de ambiente e faça uma única requisição pequena:

export LLM_API_KEY="paste-your-own-key-here"

curl https://api.groq.com/openai/v1/chat/completions \
  -H "Authorization: Bearer $LLM_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "llama-3.3-70b-versatile",
    "messages": [{"role":"user","content":"Reply with one word: ready"}],
    "max_tokens": 8
  }'

Troque a URL base e o ID do modelo para usar outro provedor compatível com OpenAI. Se a resposta falhar:

  1. 401: a chave está ausente, malformada, revogada ou foi copiada com caracteres extras.
  2. 403: o modelo, a região, a conta ou o caso de uso não é permitido.
  3. 404: a URL base ou o ID do modelo está errado.
  4. 429: você atingiu um limite de requisições, tokens ou concorrência. Diminua o ritmo; não dispare novas tentativas automáticas em um loop apertado.

Um teste bem-sucedido prova apenas que um modelo respondeu uma vez. Ele não confirma que as cotas serão renovadas, que o uso em produção é permitido ou que todos os modelos terão o mesmo comportamento.

Escolha pela carga de trabalho, não pela palavra “gratuito”

Seu cenárioComece comMotivoPrincipal concessão
Primeiro experimento com APIGoogle AI StudioCadastro rápido e modelos Flash multimodaisAPI nativa do provedor e condições de uso dos dados
Protótipo com SDK da OpenAIGroqEndpoint conhecido e velocidade interativaLimites específicos por modelo podem mudar
Comparar muitos modelosOpenRouterUma chave e várias rotas :freeDisponibilidade rotativa e erros dos provedores upstream
Testar um catálogo amplo de modelos abertosNVIDIA NIMMuitos endpoints de avaliaçãoVerificação por telefone e termos de avaliação
Teste multilíngue ou de programaçãoMistralFamília ampla de modelos e cota compartilhadaBaixa taxa de requisições e créditos compartilhados
Aplicação nativa da CloudflareWorkers AICota diária dentro da CloudflareContabilização por Neurons e cota compartilhada na conta
Protótipo baseado no GitHubGitHub ModelsPlayground de modelos convenienteLimites gratuitos pequenos ou dependentes da conta
Script sequencial em chinês e inglêsZ.aiRotas gratuitas do GLM FlashUma requisição simultânea

Quando as chaves gratuitas deixam de fazer sentido

Uma chave gratuita não é uma boa escolha para um serviço de produção que precise de SLA, vazão previsível ou garantias sobre dados de clientes. Também não é adequada para um proxy público: o provedor pode proibir a revenda do acesso, e uma chave compartilhada pode ser revogada sem aviso.

Crie a chave você mesmo, mantenha-a no servidor, troque-a se ela aparecer em logs e nunca use uma chave copiada de um repositório público. Uma chave pública pode já estar esgotada ou comprometida, e utilizá-la pode expor seus prompts a um intermediário desconhecido.

“Vou matar alguém, por que diabos as pessoas anunciam APIs de LLM gratuitas se elas não oferecem isso de verdade e apenas respondem com um erro de limite antes mesmo de você conseguir enviar um prompt?” — @bunny3111039587, um usuário real comentando sobre o acesso a APIs gratuitas de LLM.

Trate um endpoint gratuito como um experimento com uma condição clara de parada, não como substituto para capacidade paga.

Perguntas frequentes sobre chaves de API gratuitas para LLM

Posso conseguir uma chave de API gratuita para LLM sem cartão de crédito ou número de telefone?

Frequentemente, sim. Google AI Studio, Groq e OpenRouter costumam ser documentados como opções baseadas em e-mail, enquanto NVIDIA NIM e algumas contas da Mistral podem solicitar verificação por telefone. Os requisitos variam conforme a região e a conta, então confira a tela de cadastro atual.

Posso conseguir uma chave de API gratuita para GPT?

Você pode obter acesso gratuito a alguns modelos da família GPT por meio de uma plataforma hospedada ou de um programa para desenvolvedores, mas isso não é o mesmo que ter uma chave de API da OpenAI permanentemente gratuita. Verifique se a rota oferece um teste, acesso exclusivo para protótipos ou um gateway de terceiros.

Posso conseguir uma chave de API gratuita para Claude?

Não presuma que exista uma chave de API do Claude de primeira parte, permanentemente gratuita e disponível de forma geral. Alguns gateways oferecem rotas compatíveis com Claude, mas podem exigir créditos, ter termos próprios ou usar um endpoint compatível com a Anthropic.

As chaves de API gratuitas expiram?

Os níveis recorrentes podem não ter uma data de expiração definida, enquanto créditos de teste expiram ou acabam. O provedor também pode revogar uma chave, aposentar um modelo, alterar uma cota ou remover uma rota gratuita. Registre quando você consultou os limites do provedor.

Posso usar comercialmente uma chave de API gratuita para LLM?

Não automaticamente. Rotas de teste e avaliação podem proibir o uso em produção ou comercial, e os provedores de modelos podem impor restrições adicionais. Leia os termos atuais do provedor e do modelo antes de lançar um recurso comercial.

O que devo fazer depois de receber um erro 429?

Leia os cabeçalhos da resposta e o painel de cotas. Em seguida, reduza a concorrência, adicione um recuo exponencial, encurte as requisições ou mude para um fallback permitido. Não alterne entre chaves de outras pessoas nem sobrecarregue o mesmo endpoint.

A resposta prática para “qual LLM oferece uma chave de API gratuita?” é começar pelo Google AI Studio para trabalho multimodal, pela Groq para um protótipo no estilo OpenAI ou pelo OpenRouter para ter mais opções de modelos. Quando o projeto precisar de vazão previsível ou prompts privados, passe para capacidade paga ou hospedada por você.

>_Diretório de modelos AIReiter

Acesso API rápido aos modelos relacionados a este guia

Claude Opus 5

Chat

Um modelo premium do Claude para raciocínio complexo, programação e trabalho profissional com contexto longo.

AnthropicCriar API Key >

Gemini 3.8 Flash

Chat

Long-context Flash model for coding, agents, and enterprise workflows.

GoogleCriar API Key >

DeepSeek V4 Pro

Chat

DeepSeek V4 Pro para raciocínio aprofundado de código, planejamento de arquitetura e análise técnica.

DeepseekCriar API Key >

Claude Fable 5

Chat

Um modelo premium Claude para raciocínio profundo e trabalhos complexos de longo formato.

AnthropicCriar API Key >

Claude Fable 5.1

Chat

Mythos-class model for long-horizon coding, research, and knowledge work.

AnthropicCriar API Key >

Posts recentes

Suno v6 vs v6-wild vs v6-mini: guia de workflow por gênero

2026-09-12

Uso comercial e direitos autorais no Suno v6: os riscos que criadores ainda correm

2026-09-12

Review do Suno v6: upgrade ou migração forçada? (2026)

2026-09-12

API OpenRouter Fusion Flash: status, configuração e correção de erros 400

2026-09-11
AIREITER

Dúvidas? Entre em contato em
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

Vídeo IA

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

Imagem IA

GPT-Image 2.5Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image Turbo

Blog

Ver Tudo →

Empresa

Política de PrivacidadeTermos de ServiçoPolítica de Reembolso

© 2026 AIReiter. Todos os direitos reservados.