AIREITER
MoonshotText Chat

Kimi K3 AI Chat Playground e API

Experimente o Kimi K3 online para bases de código com contexto longo, coleções de pesquisa, revisão de documentos e memória de agentes por meio de uma API Chat Completions compatível com a OpenAI.

EntradaOficial $3.00 por 1 milhao de tokensAIReiter $1.50 por 1 milhao de tokensSaídaOficial $15.00 por 1 milhao de tokensAIReiter $7.50 por 1 milhao de tokensLeitura de cacheOficial $0.30 por 1 milhao de tokensAIReiter $0.15 por 1 milhao de tokens
Executar com API

ENTRADA

SAÍDA

Example
Generated in
42.7 seconds
Token de entrada
134
Token de saída
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Detalhes do modelo

Use a mesma chave de modelo no Playground, nas solicitações da API e nos fluxos de trabalho internos.

ID do modelo
kimi-k3
Provedor
Moonshot
Protocolo
OpenAI Chat Completions · Anthropic Messages
Janela de contexto
1,048,576 tokens
Saída máxima
131,072 tokens
Token de entrada
150 créditos / 1 mi de tokens
Token de saída
750 créditos / 1 mi de tokens
Leitura de cache
15 créditos / 1 mi de tokens
Gravação de cache
-

O que você pode fazer com o Kimi K3

Escolha o Kimi K3 quando o contexto for o gargalo e uma única solicitação precisar carregar um grande conjunto de trabalho de código, documentos, evidências ou histórico do agente.

Revisão com Contexto Longo

Mantenha grandes bases de código, coleções de documentos ou evidências de pesquisa juntas em um único contexto de trabalho.

Análise de Repositório

Rastreie relações entre arquivos e discuta alterações com mais do estado do projeto disponível.

Síntese de Pesquisa

Compare afirmações em muitas notas e fontes antes de produzir uma conclusão estruturada.

Avaliação de Memória de Agente

Revise longos rastros de ferramentas e decisões anteriores para descobrir onde um fluxo de trabalho automatizado deu errado.

Casos de Uso do Kimi K3

Mais adequado para fluxos de trabalho em que preservar mais evidências no prompt pode evitar fragmentação prematura, recuperação ou perda do estado do projeto.
01

Revisão de Base de Código

Analise mais contexto do repositório em uma única solicitação.

02

Conjuntos de Documentos Longos

Revise contratos, políticas, relatórios ou coleções de pesquisa.

03

Análise de Rastros de Agente

Inspecione históricos longos de ferramentas e o estado mantido.

04

Protótipos com Muito Contexto

Teste se mais contexto melhora os resultados antes de construir a recuperação.

Como Usar o Kimi K3

Teste o modelo em três etapas simples.

01

Escolha Suas Configurações

Defina os controles de resposta e as opções de upload suportadas pelo modelo.

02

Envie um Prompt

Descreva a tarefa, adicione o contexto relevante e revise a resposta em streaming e o uso de tokens.

03

Conecte a API

Use o endpoint documentado e sua API key para levar o mesmo modelo ao seu produto.

Construa com a API do Kimi K3

Passe de um teste interativo para uma integração em produção com controles previsíveis e relatório de uso.

Protocolos familiares

Use o protocolo da API configurado para este modelo, incluindo streaming quando disponível.

Visibilidade de uso

Acompanhe tokens de entrada, tokens de saída e créditos consumidos após cada resposta.

Controles específicos do modelo

Passe os parâmetros de geração compatíveis em vez de depender de padrões genéricos.

Uma conta e saldo

Teste e opere modelos de texto compatíveis por meio da mesma conta AIReiter e do mesmo sistema de cobrança.

FAQ do Kimi K3

Perguntas comuns sobre o playground online, preços e acesso à API.

/ 01

Para que o Kimi K3 é melhor?

Use-o quando uma solicitação precisar de um grande conjunto de trabalho de código, documentos, evidências de pesquisa ou histórico do agente.

/ 02

Qual janela de contexto está disponível para o Kimi K3?

AIReiter lista o Kimi K3 com uma janela de contexto de 1.048.576 tokens; valide os limites do cliente e os timeouts antes de enviar solicitações muito grandes.

/ 03

Posso chamar o Kimi K3 com um cliente no estilo OpenAI?

Sim. A AIReiter o expõe por meio de um endpoint Chat Completions compatível com a OpenAI.

/ 04

Como o Kimi K3 é precificado?

As taxas atuais de input, cache-read e output são exibidas pela AIReiter; confirme-as antes de usar em produção.

/ 05

Quando devo escolher um modelo menor em vez disso?

Use um modelo mais leve para solicitações curtas e sem estado que não se beneficiam da capacidade de contexto longo do Kimi K3.