Сложный контекст в одном запросе
Подходит для больших кодовых баз, документов с большим числом доказательств и долгих Agent-задач без агрессивного дробления.
Модель / Kimi K3
Статус за 24 ч
Трафика пока нет
Провайдер
Moonshot AI
Модель
Kimi K3
Окно контекста
1,048,576 Token
Протокол
Chat Completions
Kimi K3 — текстовая модель с длинным контекстом для рабочих процессов, где важно удерживать достаточно фактов в prompt: кодовые репозитории, юридические и policy-документы, исследовательские заметки, логи, прошлые вызовы инструментов и память Agent. AIReiter предоставляет модель через OpenAI-совместимый Chat endpoint.
Лучший сценарий
Маршрут для long-context reasoning
Используйте Kimi K3, когда один большой запрос должен нести весь рабочий контекст, без предварительного retrieval или chunking.
Подходит для больших кодовых баз, документов с большим числом доказательств и долгих Agent-задач без агрессивного дробления.
AIReiter открывает Kimi K3 через OpenAI Chat Completions, поэтому существующим приложениям обычно достаточно изменить baseURL и model.
Когда стабильные system prompts, контекст проекта или префиксы документов повторяются, проверяйте чтение кэша прямо в полях usage.
Оцените число вызовов по текущей смеси Token.
$10
около 13 тестовых запросов
Быстрый тест
$50
около 65 тестовых запросов
Ежедневная разработка
$100
около 130 тестовых запросов
Оценка для production
Цены
Цены указаны за 1M Token. AIReiter сейчас показывает Kimi K3 по публичной цене модели; ценность страницы — быстрый доступ, ясный endpoint и видимость usage.
| Тип Token | Тариф | Примечания |
|---|---|---|
| Ввод | $3.00 / 1M | Prompt Token, когда стабильный префикс не отдан из кэша. |
| Чтение кэша | $0.30 / 1M | Кэшированные prompt Token, указанные в полях usage. |
| Вывод | $15.00 / 1M | Сгенерированные Token ответа, включая reasoning-heavy ответы. |
Production-слой
Модель особенно полезна, когда непрерывность контекста меняет результат: она не просто отвечает, а несёт состояние проекта, факты и tool outputs для надёжного следующего шага.
Проверяйте архитектурные заметки, service contracts, старые тесты, diffs и issues перед рискованным изменением.
Читайте договоры, политики, исследовательские заметки и доказательства в одном рабочем контексте без раннего сжатия важных деталей.
Сохраняйте tool call IDs, наблюдения, параметры и решения, чтобы следующие шаги оставались согласованными.
Используйте Kimi K3, чтобы понять, хватит ли прототипу, миграции или Agent workflow контекста для production edge cases.
Production checklist
Long-context модели ломаются иначе, чем короткие prompt-модели. Проверьте model ID, путь контекста, состояние диалога и usage records.
В API-запросах отправляйте kimi-k3. page-chat key chat-kimi-k3 предназначен только для AIReiter chat UI.
Здесь Kimi K3 поддерживает 1,048,576 Token. Убедитесь, что клиент, proxy и timeout-настройки выдерживают большие запросы.
Длинные Agent-запуски требуют прошлых assistant messages, tool outputs и параметров. Их удаление создаёт ложную непрерывность.
Чтение кэша, выходные Token и reasoning-heavy ответы нужно измерять по usage, а не угадывать по числу запросов.
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.AIREITER_API_KEY,
baseURL: "https://aireiter.com/api/v1",
});
const stream = await client.chat.completions.create({
model: "kimi-k3",
messages: [
{ role: "user", content: "Проанализируйте этот репозиторий и найдите три самые рискованные предпосылки реализации." }
],
stream: true,
});
for await (const chunk of stream) {
process.stdout.write(chunk.choices[0]?.delta?.content ?? "");
}curl "https://aireiter.com/api/v1/chat/completions" -H "Authorization: Bearer $AIREITER_API_KEY" -H "Content-Type: application/json" -d '{
"model": "kimi-k3",
"messages": [
{ "role": "user", "content": "Проанализируйте этот репозиторий и найдите три самые рискованные предпосылки реализации." }
],
"stream": true
}'{
"model": "kimi-k3",
"messages": [
{ "role": "system", "content": "<стабильный контекст репозитория или документа>" },
{ "role": "user", "content": "Проверьте сегодняшний diff относительно этого контекста." }
],
"stream": true
}
// Подтвердите чтение кэша через usage:
// usage.prompt_tokens_details.cached_tokens > 0Сценарии
В этих случаях окно 1M Token меняет workflow сильнее, чем небольшая разница в latency или стиле.
Читайте project brief, архитектурные заметки, логи и свежие diffs в одном запросе.
Для review кодовой базы, поиска рисков, планирования миграций и критики реализации.
Сводите и сопоставляйте много длинных документов без предварительного retrieval.
Держите tool traces, историю задач и решения в окне диалога.
Оценка цена-качество
В production оценивайте стоимость полезного результата: retries, ручные правки, успех tools, cache hits и время до надёжного ответа.
Если Kimi K3 снижает retries и удерживает больше контекста, больше Token всё равно может дать меньшую итоговую стоимость задачи. Для коротких stateless-задач лучше лёгкая модель.
Сравнение
| Параметр | Kimi K3 | GPT-5.6 Sol | Gemini 3.1 Pro | Claude Sonnet 4.6 |
|---|---|---|---|---|
| Параметр | kimi-k3 | gpt-5.6-sol | chat-gemini-3.1-pro | chat-claude-sonnet-4-6 |
| Протокол AIReiter | Chat Completions | Страница семейства Chat / Responses | Маршрут Chat model | Маршрут Claude Messages |
| Лучший сценарий | Кодовые базы 1M context, длинные документы, состояние Agent | OpenAI-совместимый flagship reasoning | Большой контекст, multimodal и документные задачи | Code review и оценка документов |
| Когда выбирать | Когда непрерывность контекста — узкое место | Когда нужны качество или routing GPT-5.6 | Когда важно поведение Gemini с документами или multimodal | Когда важна Claude-style coding quality |
Готово к тесту
Быстрый путь: создайте API Key, оставьте Chat Completions endpoint и начните с маленького streaming-запроса.
FAQ
Публичные страницы обычно указывают Kimi K3: $3.00 за 1M cache-miss input Token, $0.30 за 1M cache-read input Token и $15.00 за 1M output Token.
Kimi K3 указан с окном 1,048,576 Token, поэтому его оценивают для кодовых баз, длинных документов и Agent traces.
Да. Кэшированный ввод обычно стоит $0.30 за 1M Token против $3.00 за 1M не кэшированного ввода.
Используйте "kimi-k3" в поле model и отправляйте на https://aireiter.com/api/v1/chat/completions. Не используйте внутренний page-chat key как публичный model ID.
Да. Укажите baseURL https://aireiter.com/api/v1, используйте Chat Completions и отправьте model "kimi-k3".
Cache-read Token, output Token, latency длинных запросов, retry rate и полезность reasoning-heavy ответов.