Бесплатные API-ключи к нейросетям: 8 площадок и настройка Claude Code, Cursor и Codex

Доступ к сильным моделям без оплаты закрывается ключом, который выдают сами провайдеры. Ниже восемь площадок с постоянным бесплатным уровнем, их настоящие лимиты, порядок получения ключа и три готовые настройки: Claude Code, Cursor и Codex. Всё проверяемо, карта не нужна нигде, кроме одного случая, и этот случай назван отдельно.

Бесплатные API-ключи к нейросетям: восемь провайдеров с постоянным free-уровнем, реальные лимиты запросов, порядок получения ключа и готовые настройки для Claude Code, Cursor и Codex.

Работай сверху вниз. Сначала выбери провайдера под задачу по таблице лимитов, потом получи ключ по шагам, потом вставь его в свой инструмент готовой командой. Ключ это строка вида gsk_... или nvapi-..., она заменяет оплату и хранится у тебя. Никому её не показывай и не клади в публичный репозиторий.

Почему это работает и в чём подвох

Провайдеры раздают бесплатный уровень, чтобы разработчики строили на их инфраструктуре. Взамен ты получаешь ограничение по числу запросов в минуту и в сутки. Для личных проектов, агентов и тестов этих лимитов хватает с запасом, для нагруженного прода уже нет. Дальше везде указаны настоящие цифры, чтобы ты выбирал с открытыми глазами.

Второй подвох честнее назвать сразу: бесплатный уровень провайдер меняет когда захочет. У Groq в 2026 году лимит по большинству моделей опустили до 1000 запросов в сутки. Поэтому держи ключи от двух-трёх площадок сразу.

Восемь площадок и их настоящие лимиты

Таблица собрана по открытому каталогу free-llm-провайдеров. Слева площадка, справа то, что решает выбор: сколько моделей, что требуют при регистрации и какой потолок запросов.

NVIDIA NIM. Около 125 моделей, при регистрации просят подтвердить телефон. До 40 запросов в минуту, суточного потолка по токенам нет. Самый широкий выбор моделей из бесплатных.

Groq. Двенадцать моделей, карта не нужна. Для llama-3.3-70b-versatile это 30 запросов в минуту. Главное преимущество это скорость ответа, он заметно быстрее остальных.

Google Gemini. Семнадцать моделей, карта не нужна. Для gemini-3.6-flash это 15 запросов в минуту и 1500 в сутки. Хорош длинным контекстом и работой с картинками.

Cloudflare Workers AI. Тридцать девять моделей, карта не нужна. Лимит общий и считается в нейронах, 10 тысяч в сутки на все модели сразу.

ModelScope. Пятьдесят пять моделей, нужна только регистрация. Две тысячи запросов в сутки на всё. Здесь живут китайские модели, включая линейки, которых нет у западных площадок.

Cohere. Двенадцать моделей, карта не нужна. Двадцать запросов в минуту. Сильна на задачах поиска и работы с документами.

Mistral AI. Двенадцать моделей, карта не нужна. Примерно один запрос в секунду. Европейская площадка, удобна, когда важен регион обработки.

OpenRouter. Двадцать шесть моделей и 1000 запросов в сутки, но после исчерпания бесплатного уровня площадка просит пополнить счёт на 10 долларов. Это единственный пункт списка, где деньги появляются, и он оправдан одним: OpenRouter умеет прикидываться Anthropic, поэтому именно через него проще всего подменить движок в Claude Code.

Как получить ключ: три шага

Порядок одинаковый почти везде, показываю на Groq, дальше по аналогии.

Шаг 1. Заходишь на сайт провайдера и регистрируешься через почту или аккаунт GitHub. У NVIDIA NIM дополнительно подтверждаешь телефон, у остальных из списка этого не просят.

Шаг 2. В личном кабинете ищешь раздел API Keys, он же «Ключи». Жмёшь создать новый, даёшь ему понятное имя, например claude-code или cursor, чтобы потом знать, какой отзывать.

Шаг 3. Копируешь строку целиком и сохраняешь её у себя. Второй раз её не покажут нигде, при потере ключ отзывают и создают новый. Хранить лучше в менеджере паролей, а в проекте подставлять переменной окружения.

Проверить ключ можно одной командой в терминале, ответ придёт списком доступных моделей. Подставь свой ключ вместо ВАШ_КЛЮЧ.

Промпт
curl https://api.groq.com/openai/v1/models -H "Authorization: Bearer ВАШ_КЛЮЧ"

Claude Code на бесплатном ключе

Claude Code ходит по протоколу Anthropic, поэтому подменить движок можно только там, где этот протокол поддерживают. Из списка выше это OpenRouter.

Открываешь терминал и выставляешь две переменные. После этого Claude Code пойдёт в OpenRouter вместо Anthropic, а модель выбираешь его обычными настройками.

Промпт
export ANTHROPIC_BASE_URL="https://openrouter.ai/api" export ANTHROPIC_AUTH_TOKEN="ВАШ_КЛЮЧ" claude

Чтобы не вводить это каждый раз, положи обе строки в конец файла ~/.zshrc на маке или ~/.bashrc на линуксе, потом перезапусти терминал.

Промпт
echo 'export ANTHROPIC_BASE_URL="https://openrouter.ai/api"' >> ~/.zshrc echo 'export ANTHROPIC_AUTH_TOKEN="ВАШ_КЛЮЧ"' >> ~/.zshrc

Вернуться на обычный Claude просто: убери эти две строки из файла либо выполни в терминале unset для обеих переменных.

Промпт
unset ANTHROPIC_BASE_URL unset ANTHROPIC_AUTH_TOKEN

Cursor на бесплатном ключе

Здесь всё через интерфейс, терминал не нужен.

Открываешь Settings, раздел Models, пункт Add Model. В поле базового адреса вставляешь адрес провайдера, ниже имя модели ровно так, как оно называется у него в документации, и сам ключ. Сохраняешь и выбираешь новую модель в списке.

Базовые адреса, которые чаще всего нужны.

Промпт
Groq: https://api.groq.com/openai/v1 Gemini: https://generativelanguage.googleapis.com/v1beta/openai NVIDIA: https://integrate.api.nvidia.com/v1 OpenRouter: https://openrouter.ai/api/v1

Если модель не появилась в списке, почти всегда дело в её имени: оно должно совпадать с документацией провайдера символ в символ, включая версию.

Codex и любой другой инструмент

Почти все площадки из списка отдают запросы в формате OpenAI, поэтому подходит один и тот же приём: подменить адрес и ключ.

Промпт
export OPENAI_BASE_URL="https://api.groq.com/openai/v1" export OPENAI_API_KEY="ВАШ_КЛЮЧ"

Это же работает для скриптов на питоне через библиотеку openai, для n8n, для собственных агентов. Правило одно: где инструмент ждёт OpenAI, туда подставляется адрес провайдера и его ключ.

Как разложить задачи между площадками

Лимиты бьют по одному провайдеру, поэтому рабочая схема это два-три ключа под разные задачи.

Быстрые короткие ответы и всё, где важна скорость, отдавай Groq. Он отвечает заметно быстрее остальных, и на коротких запросах лимит в минуту почти не мешает.

Длинные документы, разбор картинок и всё, где нужен большой контекст, отдавай Gemini. Полторы тысячи запросов в сутки закрывают личную работу целиком.

Редкие тяжёлые задачи и эксперименты с необычными моделями отдавай NVIDIA NIM, там самый широкий выбор и нет суточного потолка по токенам.

Агентов, которые работают фоном и делают много мелких вызовов, сажай на Cloudflare или ModelScope, у них суточный лимит общий и расходуется мягче.

Где бесплатное не подходит

Честная граница, чтобы ты не потерял время и данные.

Рабочие данные клиентов, персональные данные и коммерческие тайны через бесплатные площадки не гоняй. Многие из них прямо пишут, что запросы бесплатного уровня могут использоваться для обучения.

Прод с обещанной клиентам скоростью на бесплатном уровне не держат. Лимит меняется без предупреждения, и сервис встанет в тот момент, когда провайдер поправит правила.

Ключ в публичном репозитории живёт минуты, боты сканируют GitHub непрерывно. Держи его в переменной окружения и добавь .env в gitignore до первого коммита.

Что дальше

Заведи два ключа прямо сейчас, Groq и Gemini, это пятнадцать минут вместе с регистрацией. Проверь оба командой из третьего раздела, положи в переменные окружения и подключи к тому инструменту, в котором работаешь каждый день. Дальше добавляй третий ключ уже под конкретную задачу, когда упрёшься в лимит первых двух.

Следующий шаг
Хочешь так же, но под свой блог и продукт?

Я собрал систему, по которой обычный человек запускает блог с нуля и набирает аудиторию без съёмок, монтажа и команды. Внутри разбор, с которого стартовал сам.

Открыть разбор: с чего начать