Бесплатные модели для ИИ-агента
Обновлено:
Подборка моделей для автономных и полуавтономных ИИ-агентов: планирование, вызов инструментов, анализ длинного контекста и выполнение многошаговых задач.
Подробнее
В подборку входят сильные reasoning- и instruct-модели. Для надёжного агента дополнительно проверяйте поддержку structured output, function calling и стабильность бесплатных квот у выбранного API-провайдера.
97 моделей
🚀 41 мощных
⚖️ 56 средних
⚡ 0 лёгких
| № | Модель | Провайдер | Параметры | Контекст | Лимит | Статус | |
|---|---|---|---|---|---|---|---|
| 1 | ⚖️ NVIDIA: Nemotron 3.5 Content Safety (free)nvidia/nemotron-3.5-content-safety:free | OpenRouter | ? | 128K | Бесплатный тариф | Онлайн | Открыть |
| 2 | 🚀 NVIDIA: Nemotron 3 Ultra (free)nvidia/nemotron-3-ultra-550b-a55b:free | OpenRouter | 550B | 1.0M | Бесплатный тариф | Онлайн | Открыть |
| 3 | ⚖️ NVIDIA: Nemotron 3 Nano Omni (free)nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free | OpenRouter | 30B | 256K | Бесплатный тариф | Онлайн | Открыть |
| 4 | 🚀 NVIDIA: Nemotron 3 Super (free)nvidia/nemotron-3-super-120b-a12b:free | OpenRouter | 120B | 262K | Бесплатный тариф | Онлайн | Открыть |
| 5 | ⚖️ NVIDIA: Nemotron 3 Nano 30B A3B (free)nvidia/nemotron-3-nano-30b-a3b:free | OpenRouter | 30B | 256K | Бесплатный тариф | Онлайн | Открыть |
| 6 | ⚖️ NVIDIA: Nemotron Nano 12B 2 VL (free)nvidia/nemotron-nano-12b-v2-vl:free | OpenRouter | 12B | 128K | Бесплатный тариф | Онлайн | Открыть |
| 7 | 🚀 LLaMA 3.3 70B Versatilellama-3.3-70b-versatile | Groq | 70B | 128K | 1 000 req/day | Кэш | Открыть |
| 8 | 🚀 DeepSeek R1 Distill LLaMA 70Bdeepseek-r1-distill-llama-70b | Groq | 70B | 128K | 1 000 req/day | Кэш | Открыть |
| 9 | ⚖️ Mistral Saba 24Bmistral-saba-24b | Groq | 24B | 32K | 1 000 req/day | Кэш | Открыть |
| 10 | ⚖️ Gemini 2.0 Flashgemini-2.0-flash | Google Gemini | ? | 1.0M | 1 500 req/day | Онлайн | Открыть |
| 11 | ⚖️ Gemini 2.0 Flash Litegemini-2.0-flash-lite | Google Gemini | ? | 1.0M | 1 500 req/day | Онлайн | Открыть |
| 12 | ⚖️ Gemini 1.5 Flashgemini-1.5-flash | Google Gemini | ? | 1.0M | 1 500 req/day | Онлайн | Открыть |
| 13 | 🚀 Gemini 1.5 Progemini-1.5-pro | Google Gemini | ? | 2.1M | 50 req/day | Онлайн | Открыть |
| 14 | ⚖️ Mistral Smallmistral-small-latest | Mistral AI | ? | 33K | 1 req/min · 500 tok/min | Кэш | Открыть |
| 15 | ⚖️ Mistral Nemoopen-mistral-nemo | Mistral AI | ? | 131K | 1 req/min · 500 tok/min | Кэш | Открыть |
| 16 | ⚖️ Mistral Embedmistral-embed | Mistral AI | ? | 8K | 1 req/min · 500 tok/min | Кэш | Открыть |
| 17 | 🚀 nim/meta/llama-3.2-90b-vision-instructnim/meta/llama-3.2-90b-vision-instruct | Together AI | 90B | 16K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 18 | ⚖️ nim/mistralai/mixtral-8x22b-instruct-v01nim/mistralai/mixtral-8x22b-instruct-v01 | Together AI | ? | 16K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 19 | 🚀 nim/meta/llama-3.3-70b-instructnim/meta/llama-3.3-70b-instruct | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 20 | 🚀 nim/nvidia/llama-3.1-nemotron-70b-instructnim/nvidia/llama-3.1-nemotron-70b-instruct | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 21 | 🚀 nim/meta/llama-3.1-70b-instructnim/meta/llama-3.1-70b-instruct | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 22 | ⚖️ nim/nv-mistralai/mistral-nemo-12b-instructnim/nv-mistralai/mistral-nemo-12b-instruct | Together AI | 12B | 16K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 23 | ⚖️ nim/mistralai/mixtral-8x7b-instruct-v01nim/mistralai/mixtral-8x7b-instruct-v01 | Together AI | ? | 16K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 24 | ⚖️ nim/nvidia/llama-3.3-nemotron-super-49b-v1nim/nvidia/llama-3.3-nemotron-super-49b-v1 | Together AI | 49B | 16K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 25 | ⚖️ Cogito V1 Preview Qwen 32Bdeepcogito/cogito-v1-preview-qwen-32B | Together AI | 32B | 131K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 26 | ⚖️ Cogito V1 Preview Qwen 14Bdeepcogito/cogito-v1-preview-qwen-14B | Together AI | 14B | 131K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 27 | 🚀 Cogito V1 Preview Llama 70Bdeepcogito/cogito-v1-preview-llama-70B | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 28 | 🚀 Cogito V1 Preview Llama 70B Turbodeepcogito/cogito-v1-preview-llama-70B-Turbo | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 29 | 🚀 Meta Llama 3.3 70B Instructmeta-llama/Llama-3.3-70B-Instruct | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 30 | ⚖️ Qwen2.5 32BQwen/Qwen2.5-32B | Together AI | 32B | 131K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 31 | 🚀 Qwen2.5 72BQwen/Qwen2.5-72B | Together AI | 72B | 131K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 32 | ⚖️ Qwen2.5 14BQwen/Qwen2.5-14B | Together AI | 14B | 131K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 33 | 🚀 Llama 3.1 70Bmeta-llama/Meta-Llama-3.1-70B | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 34 | ⚖️ Qwen2.5 32B InstructQwen/Qwen2.5-32B-Instruct | Together AI | 32B | 33K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 35 | 🚀 Llama 3.1 405Bmeta-llama/Llama-3.1-405B | Together AI | 405B | 131K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 36 | ⚖️ Devstral Small 2505mistralai/Devstral-Small-2505 | Together AI | ? | 131K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 37 | ⚖️ Mixtral 8X22b Instruct V0.1mistralai/Mixtral-8x22B-Instruct-v0.1 | Together AI | ? | 66K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 38 | ⚖️ Qwen3 14BQwen/Qwen3-14B | Together AI | 14B | 2K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 39 | ⚖️ Qwen3 30B A3bQwen/Qwen3-30B-A3B | Together AI | 30B | 41K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 40 | ⚖️ Llama 4 Scout (17Bx16E)meta-llama/Llama-4-Scout-17B-16E | Together AI | 17B | 262K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 41 | ⚖️ Magistral Small 2506mistralai/Magistral-Small-2506 | Together AI | ? | 41K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 42 | ⚖️ Qwen3 32BQwen/Qwen3-32B | Together AI | 32B | 41K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 43 | 🚀 Qwen3 235B A22b Instruct 2507 Fp8Qwen/Qwen3-235B-A22B-Instruct-2507-FP8 | Together AI | 235B | 262K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 44 | ⚖️ Qwen3 Coder 30B A3b InstructQwen/Qwen3-Coder-30B-A3B-Instruct | Together AI | 30B | 262K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 45 | 🚀 Qwen3 Next 80B A3b Instruct Fp8Qwen/Qwen3-Next-80B-A3B-Instruct-FP8 | Together AI | 80B | 4K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 46 | 🚀 Qwen3-VL-235B-A22B-Instruct-FP8Qwen/Qwen3-VL-235B-A22B-Instruct-FP8 | Together AI | 235B | 262K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 47 | ⚖️ Nvidia Nemotron 3 Nano 30B A3b Bf16nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16 | Together AI | 30B | 262K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 48 | ⚖️ Qwen3.5 35B A3bQwen/Qwen3.5-35B-A3B | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 49 | 🚀 Nvidia Nemotron 3 Super 120B A12b Fp8nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-FP8 | Together AI | 120B | 262K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 50 | ⚖️ Deepseek OCR 2deepseek-ai/DeepSeek-OCR-2 | Together AI | ? | 8K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 51 | 🚀 Qwen3.5 122B A10b Fp8Qwen/Qwen3.5-122B-A10B-FP8 | Together AI | 122B | 262K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 52 | ⚖️ Qwen3 30B A3B Instruct 2507 LoraQwen/Qwen3-30B-A3B-Instruct-2507-Lora | Together AI | 30B | 262K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 53 | 🚀 Nvidia Nemotron 3 Super 120B A12b Bf16nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-BF16 | Together AI | 120B | 262K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 54 | ⚖️ Qwen3.6 35B A3b Fp8Qwen/Qwen3.6-35B-A3B-FP8 | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 55 | ⚖️ Nemotron 3 Nano Omni 30B A3b Reasoning Fp8nvidia/nemotron-3-nano-omni-30b-a3b-reasoning-fp8 | Together AI | 30B | 131K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 56 | 🚀 Llama 3.3 70B Instruct FP8 Lorameta-llama/Llama-3.3-70B-Instruct-FP8-Lora | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 57 | ⚖️ Mixtral 8x7B Instruct V0.1 FP8 Loramistralai/Mixtral-8x7B-Instruct-v0.1-FP8-Lora | Together AI | ? | 33K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 58 | ⚖️ Llama 4 Scout 17B 16E Instruct Fp8 Lorameta-llama/Llama-4-Scout-17B-16E-Instruct-FP8-Lora | Together AI | 17B | 10.5M | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 59 | ⚖️ Llama 4 Maverick 17B 128E Instruct Nvfp4meta-llama/Llama-4-Maverick-17B-128E-Instruct-FP4 | Together AI | 17B | 1.0M | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 60 | ⚖️ Qwen3.5 35B A3B LoraQwen/Qwen3.5-35B-A3B-Lora | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 61 | ⚖️ Qwen3.6 35B A3B LoraQwen/Qwen3.6-35B-A3B-Lora | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Онлайн | Открыть |
| 62 | 🚀 LLaMA 3.1 70Bllama3.1-70b | Cerebras | 70B | 128K | 14 400 req/day · 30 req/min | Кэш | Открыть |
| 63 | ⚖️ Qwen 1.5 14B Chat@cf/qwen/qwen1.5-14b-chat-cp | Cloudflare | 14B | 33K | 10 000 req/day | Кэш | Открыть |
| 64 | 🚀 Google: Nano Banana Pro (Gemini 3 Pro Image Preview)google/gemini-3-pro-image-preview | OrcaRouter | ? | 66K | Бесплатный тариф | Онлайн | Открыть |
| 65 | ⚖️ Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)google/gemini-3.1-flash-image-preview | OrcaRouter | ? | 66K | Бесплатный тариф | Онлайн | Открыть |
| 66 | 🚀 Codellama 70bmeta/codellama-70b | NVIDIA Build | 70B | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 67 | ⚖️ Codestral 22b Instruct V0.1mistralai/codestral-22b-instruct-v0.1 | NVIDIA Build | 22B | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 68 | 🚀 Deepseek V4 Flashdeepseek-ai/deepseek-v4-flash | NVIDIA Build | ? | 131K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 69 | 🚀 Deepseek V4 Prodeepseek-ai/deepseek-v4-pro | NVIDIA Build | ? | 131K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 70 | ⚖️ Granite 34b Code Instructibm/granite-34b-code-instruct | NVIDIA Build | 34B | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 71 | 🚀 Jamba 1.5 Large Instructai21labs/jamba-1.5-large-instruct | NVIDIA Build | ? | 262K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 72 | 🚀 LLAMA 3.1 70b Instructmeta/llama-3.1-70b-instruct | NVIDIA Build | 70B | 131K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 73 | ⚖️ LLAMA 3.1 Nemotron 51b Instructnvidia/llama-3.1-nemotron-51b-instruct | NVIDIA Build | 51B | 131K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 74 | 🚀 LLAMA 3.1 Nemotron 70b Instructnvidia/llama-3.1-nemotron-70b-instruct | NVIDIA Build | 70B | 131K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 75 | 🚀 LLAMA 3.1 Nemotron Ultra 253b V1nvidia/llama-3.1-nemotron-ultra-253b-v1 | NVIDIA Build | 253B | 131K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 76 | 🚀 LLAMA 3.2 90b Vision Instructmeta/llama-3.2-90b-vision-instruct | NVIDIA Build | 90B | 131K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 77 | 🚀 LLAMA 3.3 70b Instructmeta/llama-3.3-70b-instruct | NVIDIA Build | 70B | 131K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 78 | ⚖️ LLAMA 3.3 Nemotron Super 49b V1nvidia/llama-3.3-nemotron-super-49b-v1 | NVIDIA Build | 49B | 131K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 79 | ⚖️ LLAMA 3.3 Nemotron Super 49b V1.5nvidia/llama-3.3-nemotron-super-49b-v1.5 | NVIDIA Build | 49B | 131K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 80 | 🚀 Llama2 70bmeta/llama2-70b | NVIDIA Build | 70B | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 81 | 🚀 Llama3 Chatqa 1.5 70bnvidia/llama3-chatqa-1.5-70b | NVIDIA Build | 70B | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 82 | 🚀 Mistral Largemistralai/mistral-large | NVIDIA Build | ? | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 83 | 🚀 Mistral Large 2 Instructmistralai/mistral-large-2-instruct | NVIDIA Build | ? | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 84 | 🚀 Mistral Medium 3.5 128bmistralai/mistral-medium-3.5-128b | NVIDIA Build | 128B | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 85 | ⚖️ Mistral Nemo 12b Instructnv-mistralai/mistral-nemo-12b-instruct | NVIDIA Build | 12B | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 86 | ⚖️ Mistral Nemotronmistralai/mistral-nemotron | NVIDIA Build | ? | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 87 | ⚖️ Mixtral 8x22b V0.1mistralai/mixtral-8x22b-v0.1 | NVIDIA Build | ? | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 88 | ⚖️ Nemotron 3 Nano 30b A3bnvidia/nemotron-3-nano-30b-a3b | NVIDIA Build | 30B | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 89 | ⚖️ Nemotron 3 Nano Omni 30b A3b Reasoningnvidia/nemotron-3-nano-omni-30b-a3b-reasoning | NVIDIA Build | 30B | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 90 | 🚀 Nemotron 3 Super 120b A12bnvidia/nemotron-3-super-120b-a12b | NVIDIA Build | 120B | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 91 | 🚀 Nemotron 3 Ultra 550b A55bnvidia/nemotron-3-ultra-550b-a55b | NVIDIA Build | 550B | 1.0M | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 92 | 🚀 Nemotron 4 340b Instructnvidia/nemotron-4-340b-instruct | NVIDIA Build | 340B | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 93 | ⚖️ Nemotron Nano 12b V2 VLnvidia/nemotron-nano-12b-v2-vl | NVIDIA Build | 12B | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 94 | ⚖️ Nemotron Nano 3 30b A3bnvidia/nemotron-nano-3-30b-a3b | NVIDIA Build | 30B | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 95 | ⚖️ Phi 3 Vision 128k Instructmicrosoft/phi-3-vision-128k-instruct | NVIDIA Build | ? | 131K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 96 | ⚖️ Phi 3.5 Moe Instructmicrosoft/phi-3.5-moe-instruct | NVIDIA Build | ? | 33K | Free serverless inference for development; limits and model availability may change. | Онлайн | Открыть |
| 97 | ⚖️ Nemotron 3 Nano Omni 30b A3b Reasoning:Freenvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free | TokenRouter | 30B | 33K | Free models and promotional access may be time-limited; availability is checked through the Models API. | Онлайн | Открыть |