Блог
Стоимость Claude Fable 5.1 API: расчёт кэша (2026)
У Claude Fable 5.1 сохранились тарифы $10/$50 за входные и выходные токены, но чтение из кэша подешевело до $0.25 за миллион токенов. Разбираем расчёты кэша, биллинг API, проверку миграции и сценарии, где экономия действительно заметна.
Доступность Runway Solaris: что подтверждено в 2026 году
Runway Solaris официально представлен, но пока недоступен широкой публике. В этом материале разбираем ранний доступ, цены, API, надёжность, интеграции, доступность и готовность к продакшену.
OpenRouter CLI: Ori, curl, llm и aichat
Официальный CLI OpenRouter — это Ori: он запускает уже существующие инструменты для разработки, а не работает как отдельный чат-клиент. Разбираем Ori, прямые клиенты, llm и aichat, а также готовые пайплайны на curl и shell.
GFPGAN и CodeFormer для восстановления лиц: настройки и API
Практическое сравнение GFPGAN и CodeFormer для восстановления лиц: выбор по типу повреждений, настройка fidelity в CodeFormer, локальный запуск, исследования 2026 года, лицензии и стоимость API.
Цены на MiniMax H3 Max API: разбор расходов в 2026 году
Практический разбор цен MiniMax H3 Max API: стоимость секунды и клипов, расчёт на 24 часа, цены на старте, операционные расходы и случаи, когда стандартный MiniMax H3 подходит лучше.
Бесплатные кредиты OpenRouter: что на самом деле означает лимит (2026)
Практическое руководство по бесплатным кредитам и лимитам OpenRouter: порог в $10, общие квоты, ошибки 429, актуальные модели и политика провайдеров в отношении данных.
Цены GPT Image 1.5 API: стоимость одного изображения (2026)
Практическое руководство по ценам GPT Image 1.5 API: официальные тарифы для разных размеров и уровней качества, оплата токенов, стоимость редактирования, расчёт бюджета, лимиты и рекомендации по качеству.
Цены GPT Image 2 API: реальная стоимость изображения (2026)
Актуальный разбор цен GPT Image 2 API: официальные примеры стоимости генерации, тарификация по токенам, Batch, референсные изображения, повторные попытки и практический способ расчёта бюджета.
Обзор Gemini 3.5 Transcribe API (2026): сначала тестируйте, потом масштабируйте
Gemini 3.5 Transcribe — недорогой API с разными контрактами для Live и записанного аудио. Используйте его для прототипов и чистых заметок, но для чувствительных записей сохраняйте дословную расшифровку.
Open ASR Leaderboard: обновление Monsoon для хинди и индийского английского
Monsoon добавляет индийский английский в итоговое среднее и хинди в многоязычную оценку: 4 888 говорящих без пересечений между сплитами, региональные метаданные и скоринг с учётом lattice-вариантов.
Требования GLM-5.3 к железу (2026): GPU, VRAM и RAM
Полная модель GLM-5.3 разворачивается на сервере с 8 GPU в исходном формате FP8. В этом руководстве флагман отделён от Flash, а реальные бюджеты на железо сопоставлены с практическими вариантами развёртывания.
Тест редактирования изображений Midjourney V8.2: первые выводы
Тестовая edit-модель Midjourney V8.2 получила редактирование по инструкции, до четырёх референсных изображений, инпейнтинг и аутпейнтинг. В этом материале отделяем подтверждённые возможности от первых пользовательских наблюдений.
Цены Hy4 preview API: CNY, OpenRouter и ограничения
Hy4 preview стоит CNY 6/18/0.3 за миллион токенов через Tencent Cloud TokenHub, а OpenRouter указывает $0.834/$2.501/$0.042. Сравниваем лимиты маршрутов, цену кеша и варианты развёртывания.
GLM-5.3-Flash или DeepSeek V4 Flash: что выбрать?
GLM-5.3-Flash лучше подходит для нативной мультимодальности и визуальных агентов, а DeepSeek V4 Flash — первый кандидат для текстовых и кодовых задач с высокой долей кеша.
Альтернативы GLM-5.3-Flash Ox Alpha: 6 замен
Практическое руководство по альтернативам GLM-5.3-Flash с учетом конкретных задач: DeepSeek V4 Flash, Qwen3.8-Flash, GLM-5.3, GPT-5.6 Terra, Claude Opus 4.8 и Kimi K3.
LiteLLM и OpenRouter: стоимость, контроль и отказоустойчивость
Нейтральное сравнение LiteLLM и OpenRouter для команд, выбирающих между самостоятельно размещаемым шлюзом и управляемым доступом к моделям. Разбираем актуальные комиссии, операционные расходы, ограничения маршрутизации и критерии выбора гибридной схемы.
Настройка LangChain с OpenRouter: базовые URL, инструменты и исправление ошибок
Практическое руководство по интеграции LangChain с OpenRouter на Python и TypeScript: нативные и устаревшие способы настройки base_url, callbacks, инструменты, структурированный вывод, Vercel AI SDK, Anthropic Agent SDK и разбор ошибок.
GLM-5.3-Flash API: цены, кэш, хостинг и ограничения
Проверенные тарифы Z.AI для GLM-5.3-Flash, примеры расчёта расходов, ограничения интеграции с API и причины, по которым доступ к open-weight модели на 320B параметров через API обычно выгоднее локального хостинга.
Gemini 3.5 Transcribe API: цены, лимиты и настройка
Практическое руководство по Gemini 3.5 Transcribe API: идентификаторы моделей, цены, сценарии для файлов и Live API, режимы транскрибации, лимиты по говорящим и временные ограничения preview-версии.
Обзор GLM-5.3-Flash: что скрывалось за Ox Alpha, цены и ограничения
Практический обзор GLM-5.3-Flash: раскрытие личности Ox Alpha, официальные характеристики, цены API, ограничения бенчмарков, требования к локальному железу и сценарии использования.