Какую модель подключить к Cline, OpenCode или Aider, если не хочется платить за токены? Мы взяли все модели, которые сейчас бесплатны по API в нашем каталоге, оставили подходящие для программирования и отсортировали их по независимому Intelligence Index от Artificial Analysis. Затем проверили, где каждая модель бесплатна на самом деле и с какими лимитами.
Рейтинг
| # | Модель | Индекс AA | GPQA Diamond | Контекст | Где бесплатно |
|---|---|---|---|---|---|
| 1 | GLM 5.3 | 44,8 | 92% | 1M | NVIDIA Build, UnoRouter |
| 2 | Kimi K3 | 43,6 | 94% | 1M | NVIDIA Build, UnoRouter |
| 3 | GLM 5.3 Flash | 41,8 | 91% | 1M | NVIDIA Build, OrcaRouter, UnoRouter |
| 4 | Qwen 3.8 Flash Next | 39,8 | 92% | 1M | UnoRouter |
| 5 | DeepSeek V4.1 Flash | 39,5 | — | — | NVIDIA Build |
| 6 | DeepSeek V4 Pro | 36,0 | 93% | 1M | UnoRouter |
| 7 | DeepSeek V4 Flash | 34,3 | 91% | 1M | OrcaRouter, UnoRouter |
| 8 | Gemini 3.6 Flash | 34,0 | 93% | 1M | UnoRouter |
| 9 | Qwen3.8 27B | 33,7 | 91% | 262K | OpenRouter, UnoRouter |
| 10 | GLM 5.2 | 33,7 | 90% | 1M | OpenRouter, UnoRouter |
Intelligence Index — общий индекс, а не чистый бенчмарк по коду, но он хорошо отражает агентное программирование, потому что включает задачи на код и работу в терминале. Там, где Artificial Analysis публикует Terminal-Bench Hard для предыдущих версий, порядок похожий: у GLM 5.2 — 50,8%, у Kimi K2.6 — 43,9%.
Чем хороша каждая модель
GLM 5.3 — лучший бесплатный универсал
Открытая MoE-модель Z.ai возглавляет бесплатный список. Хорошо справляется с правками в нескольких файлах и длинными прогонами агента, а на UnoRouter сохраняет контекст в 1M токенов. На NVIDIA Build она бесплатна для разработки — это выбор по умолчанию для Cline или OpenCode.
Kimi K3 — сильнее всех в рассуждениях, понимает картинки
Kimi K3 от Moonshot показывает лучший среди бесплатных результат GPQA Diamond (94%) и принимает изображения, что помогает отлаживать по скриншотам. Её удобно брать для планирования и сложных багов, а рутинные правки отдавать Flash-модели.
GLM 5.3 Flash — быстрая и доступная у трёх провайдеров
Почти не уступает полной версии и бесплатна сразу у трёх провайдеров. Если один маршрут упёрся в лимит, можно переключиться на другой — идеально для длинных сессий.
Qwen 3.8 и DeepSeek V4 — надёжные альтернативы
Qwen 3.8 Flash Next и линейка DeepSeek V4 сильны в алгоритмическом коде и рефакторинге. Qwen3.8 27B достаточно компактна, чтобы запускать её и локально в квантованном виде на видеокарте с 24 ГБ памяти.
Как выбрать
- Агентное программирование (Cline, OpenCode, Kilo Code): основная модель — GLM 5.3 или Kimi K3, запасная — GLM 5.3 Flash.
- Автодополнение: ни одна из этих — берите маленькую быструю модель, лучше локально.
- Вопросы по всему репозиторию: маршрут с контекстом 1M — GLM 5.3 на UnoRouter или DeepSeek V4 Pro.
- Закрытый код: предпочитайте локальные модели — бесплатные маршруты могут логировать промпты.
Настройка семи инструментов описана в статье Как подключить бесплатные модели к Cursor, Cline, OpenCode и VS Code.
Методика
В рейтинг попали текстовые модели, которые каталог помечает как подходящие для кода: специализированные Coder-модели и сильные универсальные модели. Оценки взяты из публичного лидерборда Artificial Analysis и сопоставлены автоматически; если у модели несколько конфигураций, показываем лучшую опубликованную. Недостающие оценки мы не додумываем. Доступность — по ежечасному снимку 15 провайдеров.