В 2026 году бесплатный AI API всё ещё годится не только для демо. Например, Groq даёт до 14 400 запросов в сутки к 8B-версии Llama. Но разрыв между сервисами достигает трёх порядков, а Google вообще перестал публиковать конкретные цифры для бесплатного тарифа. Все данные ниже взяты из официальной документации провайдеров и проверены 29 июля 2026 года.
Бесплатные AI API: лимиты в одной таблице
Девять сервисов позволяют получить API-ключ без банковской карты. У семи бесплатный доступ возобновляется регулярно, тогда как NVIDIA и Hugging Face выдают разовые кредиты, которые заканчиваются.
| Провайдер | Бесплатный тариф: официальные лимиты | Банковская карта | Обучает модели на ваших данных в free tier |
|---|---|---|---|
| Google Gemini API | Текстовые модели Flash и Pro доступны бесплатно; лимиты RPM/RPD для каждой модели видны только в аккаунте AI Studio | Нет | Да («Используются для улучшения наших продуктов: Да») |
| Groq | llama-3.1-8b: 30 RPM / 14 400 RPD; llama-3.3-70b: 30 RPM / 1 000 RPD / 100K TPD | Нет | По умолчанию данные не хранятся; доступен ZDR |
| OpenRouter | Модели с суффиксом :free: 20 RPM, 50 запросов в день; 1 000 запросов в день после разового пополнения на $10 | Нет, пополнение необязательно | Зависит от исходного провайдера; есть переключатель отказа |
| GitHub Models | Модели низкого уровня: 15 RPM / 150 RPD; DeepSeek-R1: 1 RPM / 8 RPD | Нет, нужен только PAT | В документации не указано |
| Cloudflare Workers AI | 10 000 Neurons в день, сброс в 00:00 UTC | Нет | Нет, это прямо гарантируется |
| Cohere | Trial key: 20 запросов в минуту, 1 000 вызовов в месяц | Нет | На странице с лимитами не указано |
| Mistral | Есть бесплатный режим; лимиты отображаются только в Admin Panel | Нет | Не указано; анонсирована бесплатная опция без хранения данных |
| Hugging Face Inference Providers | Кредиты на $0.10 в месяц, с пометкой «subject to change» | Нет | Согласно политике провайдера, через которого маршрутизируется запрос |
| NVIDIA NIM | 1 000 кредитов при регистрации, до 5 000 с корпоративным email | Нет | Не указано |
Диапазон дневных квот — от 8 запросов для DeepSeek-R1 в GitHub Models до 14 400 у 8B-эндпоинта Groq. Сравнивать строки напрямую стоит осторожно: запросы, токены, Neurons и денежные кредиты — это разные единицы.
Google AI Studio: бесплатный старт, но с двумя оговорками
Для большинства разработчиков Google AI Studio остаётся логичной первой точкой входа. Здесь без оплаты и без привязанного биллинга доступны Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 2.5 Pro и ещё восемь текстовых моделей. Для free tier достаточно «активного проекта или бесплатного пробного периода»; привязка биллинга нужна уже для платного Tier 1.
Лимиты появятся только после регистрации
На странице лимитов Google больше не публикует квоты запросов по отдельным моделям: вместо этого она отправляет в настройки проекта AI Studio. Общими остаются два правила: лимит считается на проект, а не на API-ключ, а дневные счётчики обнуляются в полночь по тихоокеанскому времени. Любую конкретную цифру RPM из сторонних источников стоит считать устаревшей, пока её не подтвердит ваш дашборд.
На бесплатном тарифе ваши промпты идут на улучшение продуктов Google
У каждой строки free tier на странице цен Google стоит отметка «Используются для улучшения наших продуктов: Да»; для платного трафика указано No. Если вы отправляете клиентские данные или информацию под NDA, одного этого пункта достаточно, чтобы отказаться от бесплатного тарифа независимо от размера квоты. Генерация изображений сюда тоже не входит: бесплатный Gemini покрывает только текст и эмбеддинги.
Groq: прозрачные дневные квоты по каждой модели
Groq публикует лимиты бесплатного тарифа для каждой модели — авторизация для просмотра не нужна:
| Модель | RPM | Запросов в день | Токенов в день |
|---|---|---|---|
| llama-3.1-8b-instant | 30 | 14 400 | 500K |
| llama-3.3-70b-versatile | 30 | 1 000 | 100K |
| openai/gpt-oss-120b | 30 | 1 000 | 200K |
| whisper-large-v3 | 20 | 2 000 | 28 800 аудиосекунд |
Главное ограничение здесь — токены в минуту. У llama-3.3-70b потолок составляет 12K TPM, поэтому задачи с длинным контекстом начнут упираться в троттлинг, даже если дневной лимит запросов выглядит щедрым. Что касается данных, Groq по умолчанию не хранит входные и выходные данные инференса и предоставляет Zero Data Retention по запросу.
Для частых коротких запросов — классификации, извлечения данных, обогащения вебхуков — 8B-эндпоинт Groq с лимитом 14 400 запросов в сутки выглядит лучшим бесплатным вариантом в этой подборке. При условии, что вам достаточно 8B-модели и вы не выходите за 6K токенов в минуту.
OpenRouter: 50 бесплатных запросов в день или 1 000 после пополнения на $10
OpenRouter даёт доступ не к каталогу одного вендора, а ко всем моделям с суффиксом :free. На 29 июля 2026 года в пуле было 15 текстовых моделей, включая NVIDIA Nemotron 3 Ultra и Ling-3.0-flash.
Лимиты общие для всех бесплатных моделей аккаунта: 20 запросов в минуту и 50 в день. Однократная покупка кредитов на $10 навсегда поднимает дневную квоту до 1 000 запросов, при этом сами $10 остаются доступными для платных моделей. На практике полезный бесплатный тариф OpenRouter требует единовременных $10.
Трафик к бесплатным моделям направляется провайдерам, работающим по собственным правилам. По умолчанию OpenRouter не блокирует тех, кто обучает модели на ваших входных данных, но в настройках приватности их можно отключить — отдельно для бесплатных и платных моделей. О практической пользе пула один разработчик написал в r/ChatGPTCoding:
«Рекомендую использовать API-ключ OpenRouter с бесплатной моделью Deepseek/Deepseek R1 0528 без ограничений и rate limit. Она умная, с сильным рассуждением».
Состав пула меняется каждый месяц; актуальные модели для программирования разобраны отдельно.
Ещё шесть бесплатных тарифов, о которых стоит знать
GitHub Models: полноценный API для экспериментов
Любой аккаунт GitHub получает API-доступ по одному personal access token: ни карта, ни отдельная регистрация не нужны. Без подписки Copilot применяется колонка Copilot Free: 15 RPM / 150 запросов в день для моделей низкого уровня, 10 RPM / 50 RPD для старших моделей. Запрос ограничен 8 000 входными и 4 000 выходными токенами. Для reasoning-моделей квоты заметно строже: DeepSeek-R1 позволяет лишь 8 запросов в сутки. GitHub предупреждает, что лимиты могут меняться без уведомления.
Cloudflare Workers AI: 10 000 Neurons в день и запрет на обучение на данных
Cloudflare считает потребление в Neurons: 10 000 в день со сбросом в 00:00 UTC — и на планах Free, и на Paid Workers. Согласно таблице пересчёта Cloudflare, это примерно 280K выходных токенов в сутки для llama-3.1-8b-fast. Компания также прямо заявляет, что не использует клиентский контент для обучения моделей или улучшения сервисов без согласия. Это самое сильное обязательство по данным среди девяти сервисов и причина выбирать Cloudflare по умолчанию для задач с чувствительной информацией.
Cohere, NVIDIA, Hugging Face и Mistral: скромные или непрозрачные условия
| Провайдер | Бесплатная квота | Ограничение |
|---|---|---|
| Cohere | Trial key: 20 запросов в минуту | Всего 1 000 вызовов в месяц: подходит для оценки, но не для работы |
| NVIDIA build.nvidia.com | 1 000 кредитов при регистрации, до 5 000 с корпоративным email | Разовые кредиты, а не постоянный тариф; соотношение кредитов и запросов не опубликовано |
| Hugging Face Inference Providers | Кредиты на $0.10 в месяц для более чем 200 моделей | Хватит только на демо, к тому же есть пометка «subject to change» |
| Mistral | Бесплатный режим для API-ключей | Лимиты не публикуются и отображаются только в Admin Panel |
Не только текст: изображения, речь и эмбеддинги за $0
За пределами текстовых моделей бесплатные тарифы встречаются реже. Лучше всего это видно по генерации изображений: модели Gemini для изображений помечены как «Not available» в free tier, поэтому FLUX от Cloudflare внутри тех же 10 000 ежедневных Neurons остаётся основным вариантом без карты. Для распознавания речи ситуация лучше: Groq выделяет whisper-large-v3 отдельную бесплатную квоту — 2 000 запросов и 28 800 аудиосекунд в день. Эмбеддинги без оплаты доступны и в Gemini через gemini-embedding-001, и в GitHub Models с лимитом 15 RPM / 150 RPD.
Для чувствительных данных выбор сокращается до двух сервисов
Cloudflare и Groq — единственные два провайдера из списка, которые письменно обязуются не обучать модели на входных данных free tier и не хранить их. Google прямо заявляет обратное. Остальные пять ничего не говорят на страницах, где такую информацию ожидаешь увидеть, а для реальных пользовательских данных это означает не безопасность, а нерешённый вопрос.
Общий или проксируемый ключ из GitHub-репозитория либо Discord-сервера вообще не стоит рассматривать: ваши запросы проходят через чужой аккаунт, а доступ исчезнет, как только его владелец потеряет его.
Когда бесплатных лимитов уже недостаточно
Бесплатный тариф перестаёт быть рабочим вариантом, когда хотя бы одна из этих ситуаций становится регулярной:
- Дневной лимит мешает реальной работе: 100K токенов в сутки у Groq 70B — это одна умеренная пакетная задача.
- Нужен класс моделей, которого нет в бесплатных планах. Передовые reasoning-модели и генерация изображений во всех девяти тарифах выше либо отсутствуют, либо ограничены.
- На переключение между провайдерами ради обхода лимитов уходит инженерное время.
Платный перерасход обходится дешевле, чем кажется. Модели класса Flash тарифицируются за миллион токенов, поэтому день сверх бесплатных 100K токенов Groq на агрегаторе вроде AIReiter будет стоить центы. Groq, OpenRouter, Cloudflare и Gemini поддерживают OpenAI-совместимые эндпоинты, так что переход обычно сводится к смене base URL.
| Ваша ситуация | Оставаться на free tier или платить? |
|---|---|
| Прототип без реальных пользовательских данных | Бесплатно: Google AI Studio для широты выбора или Groq для высокой пропускной способности |
| Чувствительные данные, небольшой объём | Бесплатно: Cloudflare Workers AI с гарантией отказа от обучения на данных |
| Хотите недорого попробовать много моделей | OpenRouter: 50 запросов в день бесплатно; разовая покупка на $10 открывает 1 000 в день |
| Дневные лимиты постоянно прерывают работу | Оплата по факту использования; бесплатные тарифы оставить как резерв |
FAQ
Есть ли полностью бесплатный AI API?
Да. На 29 июля 2026 года Google AI Studio, Groq, GitHub Models и Cloudflare Workers AI предоставляют рабочий API без привязанного способа оплаты. У каждого есть дневные или поминутные ограничения. Кроме того, бесплатный тариф Google использует ваши промпты для улучшения продуктов компании.
Какой AI API доступен бесплатно без банковской карты?
Все девять провайдеров из сравнительной таблицы выше выдают ключи без карты. Отличаются размер квоты и политика данных: сравните 14 400 запросов в день у Groq с 1 000 вызовов в месяц у Cohere или обязательство Cloudflare не обучать модели на данных с противоположной политикой Google.
Какой GPT API бесплатный?
У собственного API OpenAI нет бесплатного тарифа, однако open-weight модели gpt-oss от OpenAI бесплатно доступны на трёх платформах: Groq — gpt-oss-120b с лимитом 1 000 запросов в день, Cloudflare Workers AI — в пределах 10 000 ежедневных Neurons, и OpenRouter — openai/gpt-oss-20b:free. GitHub Models также предлагает на free tier размещённые в Azure модели OpenAI GPT, кроме серий o и GPT-5.
У какого AI API самый щедрый бесплатный тариф?
Зависит от критерия. По числу запросов лидирует Groq с llama-3.1-8b-instant и 14 400 запросами в день. По объёму токенов — Cloudflare с 10 000 Neurons в день. По качеству моделей без оплаты — Google AI Studio, где доступна Gemini 2.5 Pro, но с условием использования данных для обучения.
