Большинство AI-инструментов для программирования принимают любой OpenAI-совместимый API. Значит, в редактор или терминальный агент можно подключить бесплатные модели — GLM 5.3, Kimi K3, DeepSeek V4, Qwen 3.8 — вместо оплаты за токены. Нужны три вещи: base URL, API-ключ и ID модели. Разбираем, где их взять и куда вставить в семи популярных инструментах.
Шаг 1. Ключ и модель
Для программирования советуем начать с одного из этих провайдеров — карта нигде не нужна:
| Провайдер | Base URL | Пример бесплатной модели |
|---|---|---|
| OpenRouter | https://openrouter.ai/api/v1 | z-ai/glm-5.2:free |
| NVIDIA Build | https://integrate.api.nvidia.com/v1 | z-ai/glm-5.3, moonshotai/kimi-k3 |
| UnoRouter | https://api.unorouter.com/v1 | glm-5.3:free, deepseek-v4-flash:free |
| Google AI Studio | https://generativelanguage.googleapis.com/v1beta/openai/ | Модели Gemini Flash |
ID моделей меняются, поэтому копируйте точный ID из карточки модели в каталоге — например, GLM 5.3 или Kimi K3. На странице моделей для кода все бесплатные варианты отсортированы по бенчмаркам.
Cline (VS Code, JetBrains, CLI)
- Откройте настройки Cline и выберите API Provider.
- Выберите OpenRouter, вставьте ключ и укажите модель с суффиксом
:free— или выберите OpenAI Compatible для NVIDIA Build и UnoRouter. - Для OpenAI Compatible заполните Base URL, API Key и Model ID из таблицы выше.
Cline планирует и правит код во много шагов, поэтому быстро расходует запросы. Бесплатный лимит OpenRouter — 50 запросов в день (1000 после разового пополнения на $10): хватит на короткую сессию, но не на рабочий день. NVIDIA Build и UnoRouter щедрее для экспериментов.
Kilo Code
У Kilo Code тот же список провайдеров: выберите OpenRouter или «OpenAI Compatible» и заполните base URL, ключ и ID модели. Режимы architect/code/debug могут работать на разных моделях — сильная бесплатная модель для архитектуры и быстрая для правок хорошо дополняют друг друга.
OpenCode
OpenRouter встроен в OpenCode: выполните /connect внутри OpenCode (или opencode auth login), выберите OpenRouter, вставьте ключ и выберите бесплатную модель командой /models. Любой другой OpenAI-совместимый провайдер добавляется в opencode.json:
{
"$schema": "https://opencode.ai/config.json",
"provider": {
"nvidia": {
"npm": "@ai-sdk/openai-compatible",
"name": "NVIDIA Build",
"options": {
"baseURL": "https://integrate.api.nvidia.com/v1",
"apiKey": "{env:NVIDIA_API_KEY}"
},
"models": {
"z-ai/glm-5.3": { "name": "GLM 5.3" },
"moonshotai/kimi-k3": { "name": "Kimi K3" }
}
}
}
}
В OpenCode Zen также есть несколько моделей, бесплатных на ограниченное время, например Nemotron 3 Ultra Free, — отдельный ключ для них не нужен.
Continue
Добавьте модель в config.yaml с провайдером OpenAI и своим apiBase:
models:
- name: Kimi K3 (NVIDIA, free)
provider: openai
model: moonshotai/kimi-k3
apiBase: https://integrate.api.nvidia.com/v1
apiKey: ${{ secrets.NVIDIA_API_KEY }}
roles: [chat, edit]
Для автодополнения берите маленькую быструю модель — большая reasoning-модель будет тормозить на каждом нажатии клавиши.
Aider
Aider поддерживает OpenRouter из коробки:
export OPENROUTER_API_KEY=sk-or-...
aider --model openrouter/z-ai/glm-5.2:free
Для других провайдеров используйте --openai-api-base и --openai-api-key, а к названию модели добавьте префикс openai/.
Zed
Zed на бесплатном тарифе Personal работает со своими ключами и локальными моделями. Добавьте OpenAI-совместимого провайдера в settings.json, а ключ введите в настройках панели Agent:
"language_models": {
"openai_compatible": {
"NVIDIA Build": {
"api_url": "https://integrate.api.nvidia.com/v1",
"available_models": [
{ "name": "z-ai/glm-5.3", "display_name": "GLM 5.3", "max_tokens": 128000 }
]
}
}
}
Cursor и VS Code + Copilot
В Cursor откройте Settings → Models, введите API-ключ и включите Override OpenAI Base URL с base URL провайдера. Свой ключ работает в чате; автодополнение Tab и часть агентных функций по-прежнему используют модели и лимиты Cursor.
В VS Code с GitHub Copilot свои модели добавляются через Manage Models: OpenRouter и локальные модели Ollama работают в чате даже без платной подписки Copilot.
Как экономить лимиты
- Разделяйте роли. Самую сильную бесплатную модель используйте только для планирования и сложных багов, мелкие правки отдайте быстрой модели.
- Держите два провайдера. Когда один отвечает 429, переключайтесь на другой, а не ждите.
- Сокращайте контекст. Исключайте
node_modules, сборки и lock-файлы — бесплатные маршруты часто урезают контекст относительно максимума модели. - Автодополнение — локально. Маленькая модель в Ollama или LM Studio ничего не стоит и не имеет лимитов.
Другие инструменты с поддержкой бесплатных моделей — в подборках расширений для IDE и агентов в терминале.