moonshotText Chat

Kimi K3 AI Chat Playground y API

Prueba Kimi K3 en línea para bases de código de contexto largo, colecciones de investigación, revisión de documentos y memoria de agentes a través de una API de Chat Completions compatible con OpenAI.

Input 300 credits / 1M tokens · Output 1,500 credits / 1M tokens
Ejecutar con API
Kimi K3
kimi-k3
Streaming
AIReiter
How can I help you today?

Detalles del modelo

Usa la misma clave de modelo en Playground, solicitudes API y flujos de trabajo internos.

Model ID
kimi-k3
Proveedor
moonshot
Protocolo
OpenAI Chat Completions · Anthropic Messages · OpenAI Responses
max_tokens
4,096
Token de entrada
300 credits / 1M
Token de salida
1,500 credits / 1M

Lo que puedes hacer con Kimi K3

Elige Kimi K3 cuando el contexto sea el cuello de botella y una sola solicitud necesite incluir un gran conjunto de trabajo de código, documentos, evidencia o historial del agente.

Revisión de contexto largo

Mantén juntas en un solo contexto de trabajo grandes bases de código, colecciones de documentos o evidencia de investigación.

Análisis de repositorios

Rastrea relaciones entre archivos y analiza cambios con más estado del proyecto disponible.

Síntesis de investigación

Compara afirmaciones en muchas notas y fuentes antes de producir una conclusión estructurada.

Evaluación de memoria de agentes

Revisa largos rastros de herramientas y decisiones previas para encontrar dónde salió mal un flujo de trabajo automatizado.

Casos de uso de Kimi K3

Ideal para flujos de trabajo en los que preservar más evidencia en el prompt puede evitar el troceado prematuro, la recuperación o la pérdida del estado del proyecto.
01

Revisión de bases de código

Analiza más contexto del repositorio en una sola solicitud.

02

Conjuntos largos de documentos

Revisa contratos, políticas, informes o colecciones de investigación.

03

Análisis de trazas de agentes

Inspecciona historiales largos de herramientas y el estado retenido.

04

Prototipos con mucho contexto

Prueba si más contexto mejora los resultados antes de construir la recuperación.

Cómo usar Kimi K3

Prueba el modelo en tres pasos sencillos.
01

Elige tu configuración

Configura los controles de respuesta y las opciones de carga compatibles con el modelo.

02

Envía una instrucción

Describe la tarea, añade el contexto relevante y revisa la respuesta en streaming y el uso de tokens.

03

Conecta la API

Usa el endpoint documentado y tu clave de API para llevar el mismo modelo a tu producto.

Desarrolla con la API de Kimi K3

Pasa de una prueba interactiva a una integración de producción con controles predecibles e informes de uso.

Protocolos familiares

Usa el protocolo API configurado para este modelo, incluida la transmisión en tiempo real donde esté disponible.

Visibilidad del uso

Haz seguimiento de los tokens de entrada, los tokens de salida y los créditos consumidos después de cada respuesta.

Controles específicos del modelo

Pasa los parámetros de generación compatibles en lugar de depender de valores predeterminados genéricos.

Una sola cuenta y saldo

Prueba y utiliza los modelos de texto compatibles a través de la misma cuenta de AIReiter y el mismo sistema de facturación.

Preguntas frecuentes sobre Kimi K3

Preguntas comunes sobre el playground en línea, los precios y el acceso a la API.
¿Para qué es mejor Kimi K3?

Úsalo cuando una solicitud necesite un gran conjunto de trabajo de código, documentos, evidencia de investigación o historial del agente.

¿Qué ventana de contexto está disponible para Kimi K3?

AIReiter enumera Kimi K3 con una ventana de contexto de 1,048,576 tokens; valida los límites y tiempos de espera del cliente antes de enviar solicitudes muy grandes.

¿Puedo llamar a Kimi K3 con un cliente al estilo OpenAI?

Sí. AIReiter lo expone a través de un endpoint de Chat Completions compatible con OpenAI.

¿Cómo se fija el precio de Kimi K3?

AIReiter muestra las tarifas actuales de input, cache-read y output tokens; confírmelas antes de usarlas en producción.

¿Cuándo debería elegir un modelo más pequeño en su lugar?

Use un modelo más ligero para solicitudes breves y sin estado que no se benefician de la capacidad de contexto largo de Kimi K3.