Запустить Kimi K3 в OpenCode можно тремя командами. По прайсу модель стоит как Sonnet — $3/$15 за миллион токенов, — но реальная сессия в OpenCode в среднем обходится всего в $1.79: большую часть контекста покрывает агрессивное prompt-кэширование.
Подключаем Kimi K3 к OpenCode за три шага
OpenCode — терминальный coding-агент с открытым исходным кодом. Он умеет авторизоваться в Kimi встроенными средствами, поэтому не придётся вручную указывать base URL или править конфигурационные файлы. Инструкция ниже соответствует OpenCode 1.18.3 и официальному гайду Kimi по интеграции.
1. Добавьте API-ключ
Выполните opencode auth login, выберите провайдера Moonshot AI и вставьте ключ из Kimi Open Platform. Здесь есть два важных нюанса. Во-первых, на аккаунте должен быть реальный баланс: приветственные ваучеры для K3 не работают. Во-вторых, не сохраняйте ключ в конфиге, скриншотах или git-репозитории — OpenCode не зря хранит его в собственной системе учётных данных.
2. Выберите модель kimi-k3
В OpenCode выполните /models и выберите kimi-k3. Модель запустится с полным контекстным окном в 1 млн токенов; лимит вывода на один ответ составляет 131K токенов. В строке состояния должны появиться «Kimi K3» и «Moonshot AI».
3. Настройте интенсивность рассуждений
Команда /variants задаёт, насколько глубоко K3 будет рассуждать перед ответом. По умолчанию выбрано max; можно переключиться на high или low. Как покажет раздел о стоимости, это главный рычаг управления расходами.
Во сколько на самом деле обходится сессия с Kimi K3
Базовый тариф K3 — $3 за миллион входных токенов и $15 за миллион выходных. Это дороже промотарифа Claude Sonnet 5: $2/$10.
На практике K3 стоит заметно меньше, потому что основная масса токенов приходит из дешёвого кэша. По открытым данным использования OpenCode на странице модели ниже, средняя сессия с Kimi K3 обходится в $1.79. Показатель рассчитан по 66,379 завершённым сессиям, в каждой из которых в среднем расходуется 2.9M токенов. Получается около $0.62 на миллион фактически использованных токенов — существенно ниже заявленных $3. Причина в том, что 93% входных токенов попадают в кэш: чтение из кэша стоит $0.30 за миллион вместо $3.00, то есть на 90% дешевле. Artificial Analysis приводит смешанную цену $2.31 за миллион, но там предполагается лишь 70% кэширования. Реальные 93% в OpenCode и объясняют более низкую стоимость сессий.
Прайс остаётся на уровне Sonnet. Релиз open-weight-версии с полными весами к 27 июля 2026 года меняет возможности самостоятельного хостинга, но не цену API. Сравнение тарифов за миллион токенов выглядит так:
По объёму токенов в OpenCode Go K3 занимает 9-е место, а за восемь недель к 20 июля её использование удвоилось, согласно данным OpenCode о динамике. На бумаге модель недешёвая, но для сложных задач спрос на неё остаётся высоким.
Почему K3 расходует много токенов и как это контролировать
Главная претензия к K3 обычно не в цене токена, а в их количестве. Из-за режима рассуждений max по умолчанию модель долго думает перед действием; для простых правок это превращается в бессмысленные расходы. Один пользователь OpenCode в X в июле 2026 года сформулировал проблему прямо: на задачах, которые более лёгкая модель сделает быстрее, K3 способна потратить много токенов «без особого результата».
Держать расход под контролем помогают три вещи:
- Снизьте уровень варианта. Для рутинной работы переключайте
/variantsнаlowилиhigh. Режимmaxоправдан для архитектурных задач и рефакторинга нескольких файлов, но не для переименования функции. - Используйте кэш. Именно 93% попаданий в кэш удерживают цену сессий на низком уровне. Лучше продолжать работу в одной длинной сессии, а не начинать новую: при каждом перезапуске некэшированный контекст отправляется заново по полной цене.
- Упростите обвязку агента. Шумный scaffold подталкивает K3 к избыточным рассуждениям. Уберите постоянно подключённые файлы инструкций, неиспользуемые MCP-серверы и многословные описания инструментов — тогда будет меньше обращений к инструментам и поводов уйти в бесконечные размышления.
Есть и компромисс: в OpenCode K3 ощущается медленнее лёгких моделей — это плата за рассуждения. Если задержка важнее глубины анализа, переключайтесь на другую модель.
Kimi K3 и Kimi K2.7 Code: когда выгоднее более дешёвая модель
K3 примерно втрое дороже Kimi K2.7 Code, поэтому ключевой вопрос — в каких случаях эта разница оправданна.
Чтобы проверить более доступный вариант на практике, 2026-07-20 я вызвал K2.7 Code через API с небольшой задачей: написать на Python функцию merge_intervals и разобрать её сложность. Модель выдала корректный, идиоматичный код: сортировка, затем линейное объединение; O(n log n) по времени и O(n) по памяти. На это ушло 10.7 секунды, 52 токена в prompt и 341 токен в completion. Для повседневной разработки — исправления багов, небольших функций и заготовок тестов — большинству этого достаточно, а счёт за токены составляет лишь часть расходов на K3.
K3 стоит оставить для задач, где она сильнее: работы с длинным контекстом, заполняющим её окно в 1M токенов, сложных рассуждений по нескольким файлам и случаев, когда более лёгкая модель продолжает ошибаться. Сравнение K2.7 Code и GLM 5.2 лицом к лицу пригодится, если вы выбираете ежедневную рабочую модель, а не инструмент для самых тяжёлых задач.
Прямой API, OpenRouter или подписка: как платить меньше
Способ подключения к K3 влияет и на надёжность, и на стоимость.
Прямой API Kimi. Подключение напрямую к Kimi Open Platform — самый надёжный вариант. K3 в OpenRouter обслуживается одним провайдером и под нагрузкой может часто отвечать ошибкой 429, связанной с ограничением запросов. Прямое подключение избавляет от этого узкого места.
Подписка OpenCode Go. Месячный план примерно за $10–19 превращает K3 в условно безлимитный «второй пул», к которому можно обратиться, если основная модель застопорилась. Несколько пользователей используют её именно так: как запасной вариант, когда сессия Claude прерывается посреди задачи, а не как постоянную рабочую модель.
API-шлюз. Если вы уже вызываете несколько моделей через один ключ, совместимый с Anthropic и OpenAI шлюз вроде AIReiter позволит обращаться к K3 и другим моделям по pay-as-you-go-тарифам, сохраняя ту же экономику кэширования, которая снижает стоимость сессий. В разборе тарифов Kimi K3 есть расчёты стоимости токенов для сравнения вариантов до выбора маршрута.
Стоит ли использовать Kimi K3 в OpenCode?
Двум группам стоит подумать дважды. Если вы запускаете недорогие высоконагруженные agent-циклы, K2.7 Code или более лёгкая модель сэкономят деньги почти без потери качества. Если вам нужны быстрые ответы, рассуждения K3 в режиме max будут казаться медленными, пока не снизите вариант.
Для остальных ответ положительный. Передовая модель с контекстом 1M токенов, которую можно настроить тремя командами, с реальной стоимостью сессии ниже $2 — и с полным контролем над ней, если вы уходите от ассистента, который останавливается на середине задачи.
FAQ
Можно ли пользоваться Kimi K3 в OpenCode бесплатно?
Нет. K3 работает по модели pay-as-you-go и требует пополненного баланса Kimi Open Platform; приветственные ваучеры на неё не распространяются. Сам OpenCode бесплатен и имеет открытый исходный код — платить нужно только за токены K3.
Сколько стоит миллион токенов Kimi K3?
По прайсу — $3 за миллион входных токенов и $15 за миллион выходных. Фактическая цена обычно намного ниже: чтение из кэша стоит $0.30 за миллион, а средняя сессия в OpenCode обходится в $1.79 благодаря 93% попаданий в кэш.
Kimi K3 — это open-source?
Это open-weight-модель. Moonshot выпускает полные веса модели к 27 июля 2026 года, и она станет первой открытой моделью в классе 3 триллионов параметров. Хостинговый API при этом остаётся платным.
Может ли Kimi K3 программировать так же хорошо, как Claude?
В coding-лидерборде Arena K3 сейчас находится на вершине и набирает 57 баллов в Artificial Analysis Intelligence Index, занимая 4-е место среди 187 моделей. На сложных задачах программирования она на практике конкурентоспособна с передовыми проприетарными моделями при сопоставимой цене по прайсу.
Почему Kimi K3 выдаёт ошибки 429?
Частые 429 обычно возникают при работе через OpenRouter, где K3 обслуживается единственным провайдером. Подключение напрямую к Kimi Open Platform через встроенную авторизацию OpenCode позволяет избежать этого ограничения.