Бесплатные модели для ИИ-агента

Обновлено:

Подборка моделей для автономных и полуавтономных ИИ-агентов: планирование, вызов инструментов, анализ длинного контекста и выполнение многошаговых задач.

Подробнее

В подборку входят сильные reasoning- и instruct-модели. Для надёжного агента дополнительно проверяйте поддержку structured output, function calling и стабильность бесплатных квот у выбранного API-провайдера.

97 моделей
🚀 41 мощных
⚖️ 56 средних
⚡ 0 лёгких
Модель Провайдер Параметры Контекст Лимит Статус
1 ⚖️ NVIDIA: Nemotron 3.5 Content Safety (free)nvidia/nemotron-3.5-content-safety:free OpenRouter ? 128K Бесплатный тариф Онлайн Открыть
2 🚀 NVIDIA: Nemotron 3 Ultra (free)nvidia/nemotron-3-ultra-550b-a55b:free OpenRouter 550B 1.0M Бесплатный тариф Онлайн Открыть
3 ⚖️ NVIDIA: Nemotron 3 Nano Omni (free)nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free OpenRouter 30B 256K Бесплатный тариф Онлайн Открыть
4 🚀 NVIDIA: Nemotron 3 Super (free)nvidia/nemotron-3-super-120b-a12b:free OpenRouter 120B 262K Бесплатный тариф Онлайн Открыть
5 ⚖️ NVIDIA: Nemotron 3 Nano 30B A3B (free)nvidia/nemotron-3-nano-30b-a3b:free OpenRouter 30B 256K Бесплатный тариф Онлайн Открыть
6 ⚖️ NVIDIA: Nemotron Nano 12B 2 VL (free)nvidia/nemotron-nano-12b-v2-vl:free OpenRouter 12B 128K Бесплатный тариф Онлайн Открыть
7 🚀 LLaMA 3.3 70B Versatilellama-3.3-70b-versatile Groq 70B 128K 1 000 req/day Кэш Открыть
8 🚀 DeepSeek R1 Distill LLaMA 70Bdeepseek-r1-distill-llama-70b Groq 70B 128K 1 000 req/day Кэш Открыть
9 ⚖️ Mistral Saba 24Bmistral-saba-24b Groq 24B 32K 1 000 req/day Кэш Открыть
10 ⚖️ Gemini 2.0 Flashgemini-2.0-flash Google Gemini ? 1.0M 1 500 req/day Онлайн Открыть
11 ⚖️ Gemini 2.0 Flash Litegemini-2.0-flash-lite Google Gemini ? 1.0M 1 500 req/day Онлайн Открыть
12 ⚖️ Gemini 1.5 Flashgemini-1.5-flash Google Gemini ? 1.0M 1 500 req/day Онлайн Открыть
13 🚀 Gemini 1.5 Progemini-1.5-pro Google Gemini ? 2.1M 50 req/day Онлайн Открыть
14 ⚖️ Mistral Smallmistral-small-latest Mistral AI ? 33K 1 req/min · 500 tok/min Кэш Открыть
15 ⚖️ Mistral Nemoopen-mistral-nemo Mistral AI ? 131K 1 req/min · 500 tok/min Кэш Открыть
16 ⚖️ Mistral Embedmistral-embed Mistral AI ? 8K 1 req/min · 500 tok/min Кэш Открыть
17 🚀 nim/meta/llama-3.2-90b-vision-instructnim/meta/llama-3.2-90b-vision-instruct Together AI 90B 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
18 ⚖️ nim/mistralai/mixtral-8x22b-instruct-v01nim/mistralai/mixtral-8x22b-instruct-v01 Together AI ? 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
19 🚀 nim/meta/llama-3.3-70b-instructnim/meta/llama-3.3-70b-instruct Together AI 70B 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
20 🚀 nim/nvidia/llama-3.1-nemotron-70b-instructnim/nvidia/llama-3.1-nemotron-70b-instruct Together AI 70B 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
21 🚀 nim/meta/llama-3.1-70b-instructnim/meta/llama-3.1-70b-instruct Together AI 70B 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
22 ⚖️ nim/nv-mistralai/mistral-nemo-12b-instructnim/nv-mistralai/mistral-nemo-12b-instruct Together AI 12B 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
23 ⚖️ nim/mistralai/mixtral-8x7b-instruct-v01nim/mistralai/mixtral-8x7b-instruct-v01 Together AI ? 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
24 ⚖️ nim/nvidia/llama-3.3-nemotron-super-49b-v1nim/nvidia/llama-3.3-nemotron-super-49b-v1 Together AI 49B 16K Fair Use (По мере нагрузки серверов) Онлайн Открыть
25 ⚖️ Cogito V1 Preview Qwen 32Bdeepcogito/cogito-v1-preview-qwen-32B Together AI 32B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
26 ⚖️ Cogito V1 Preview Qwen 14Bdeepcogito/cogito-v1-preview-qwen-14B Together AI 14B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
27 🚀 Cogito V1 Preview Llama 70Bdeepcogito/cogito-v1-preview-llama-70B Together AI 70B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
28 🚀 Cogito V1 Preview Llama 70B Turbodeepcogito/cogito-v1-preview-llama-70B-Turbo Together AI 70B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
29 🚀 Meta Llama 3.3 70B Instructmeta-llama/Llama-3.3-70B-Instruct Together AI 70B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
30 ⚖️ Qwen2.5 32BQwen/Qwen2.5-32B Together AI 32B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
31 🚀 Qwen2.5 72BQwen/Qwen2.5-72B Together AI 72B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
32 ⚖️ Qwen2.5 14BQwen/Qwen2.5-14B Together AI 14B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
33 🚀 Llama 3.1 70Bmeta-llama/Meta-Llama-3.1-70B Together AI 70B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
34 ⚖️ Qwen2.5 32B InstructQwen/Qwen2.5-32B-Instruct Together AI 32B 33K Fair Use (По мере нагрузки серверов) Онлайн Открыть
35 🚀 Llama 3.1 405Bmeta-llama/Llama-3.1-405B Together AI 405B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
36 ⚖️ Devstral Small 2505mistralai/Devstral-Small-2505 Together AI ? 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
37 ⚖️ Mixtral 8X22b Instruct V0.1mistralai/Mixtral-8x22B-Instruct-v0.1 Together AI ? 66K Fair Use (По мере нагрузки серверов) Онлайн Открыть
38 ⚖️ Qwen3 14BQwen/Qwen3-14B Together AI 14B 2K Fair Use (По мере нагрузки серверов) Онлайн Открыть
39 ⚖️ Qwen3 30B A3bQwen/Qwen3-30B-A3B Together AI 30B 41K Fair Use (По мере нагрузки серверов) Онлайн Открыть
40 ⚖️ Llama 4 Scout (17Bx16E)meta-llama/Llama-4-Scout-17B-16E Together AI 17B 262K Fair Use (По мере нагрузки серверов) Онлайн Открыть
41 ⚖️ Magistral Small 2506mistralai/Magistral-Small-2506 Together AI ? 41K Fair Use (По мере нагрузки серверов) Онлайн Открыть
42 ⚖️ Qwen3 32BQwen/Qwen3-32B Together AI 32B 41K Fair Use (По мере нагрузки серверов) Онлайн Открыть
43 🚀 Qwen3 235B A22b Instruct 2507 Fp8Qwen/Qwen3-235B-A22B-Instruct-2507-FP8 Together AI 235B 262K Fair Use (По мере нагрузки серверов) Онлайн Открыть
44 ⚖️ Qwen3 Coder 30B A3b InstructQwen/Qwen3-Coder-30B-A3B-Instruct Together AI 30B 262K Fair Use (По мере нагрузки серверов) Онлайн Открыть
45 🚀 Qwen3 Next 80B A3b Instruct Fp8Qwen/Qwen3-Next-80B-A3B-Instruct-FP8 Together AI 80B 4K Fair Use (По мере нагрузки серверов) Онлайн Открыть
46 🚀 Qwen3-VL-235B-A22B-Instruct-FP8Qwen/Qwen3-VL-235B-A22B-Instruct-FP8 Together AI 235B 262K Fair Use (По мере нагрузки серверов) Онлайн Открыть
47 ⚖️ Nvidia Nemotron 3 Nano 30B A3b Bf16nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16 Together AI 30B 262K Fair Use (По мере нагрузки серверов) Онлайн Открыть
48 ⚖️ Qwen3.5 35B A3bQwen/Qwen3.5-35B-A3B Together AI 35B 262K Fair Use (По мере нагрузки серверов) Онлайн Открыть
49 🚀 Nvidia Nemotron 3 Super 120B A12b Fp8nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-FP8 Together AI 120B 262K Fair Use (По мере нагрузки серверов) Онлайн Открыть
50 ⚖️ Deepseek OCR 2deepseek-ai/DeepSeek-OCR-2 Together AI ? 8K Fair Use (По мере нагрузки серверов) Онлайн Открыть
51 🚀 Qwen3.5 122B A10b Fp8Qwen/Qwen3.5-122B-A10B-FP8 Together AI 122B 262K Fair Use (По мере нагрузки серверов) Онлайн Открыть
52 ⚖️ Qwen3 30B A3B Instruct 2507 LoraQwen/Qwen3-30B-A3B-Instruct-2507-Lora Together AI 30B 262K Fair Use (По мере нагрузки серверов) Онлайн Открыть
53 🚀 Nvidia Nemotron 3 Super 120B A12b Bf16nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-BF16 Together AI 120B 262K Fair Use (По мере нагрузки серверов) Онлайн Открыть
54 ⚖️ Qwen3.6 35B A3b Fp8Qwen/Qwen3.6-35B-A3B-FP8 Together AI 35B 262K Fair Use (По мере нагрузки серверов) Онлайн Открыть
55 ⚖️ Nemotron 3 Nano Omni 30B A3b Reasoning Fp8nvidia/nemotron-3-nano-omni-30b-a3b-reasoning-fp8 Together AI 30B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
56 🚀 Llama 3.3 70B Instruct FP8 Lorameta-llama/Llama-3.3-70B-Instruct-FP8-Lora Together AI 70B 131K Fair Use (По мере нагрузки серверов) Онлайн Открыть
57 ⚖️ Mixtral 8x7B Instruct V0.1 FP8 Loramistralai/Mixtral-8x7B-Instruct-v0.1-FP8-Lora Together AI ? 33K Fair Use (По мере нагрузки серверов) Онлайн Открыть
58 ⚖️ Llama 4 Scout 17B 16E Instruct Fp8 Lorameta-llama/Llama-4-Scout-17B-16E-Instruct-FP8-Lora Together AI 17B 10.5M Fair Use (По мере нагрузки серверов) Онлайн Открыть
59 ⚖️ Llama 4 Maverick 17B 128E Instruct Nvfp4meta-llama/Llama-4-Maverick-17B-128E-Instruct-FP4 Together AI 17B 1.0M Fair Use (По мере нагрузки серверов) Онлайн Открыть
60 ⚖️ Qwen3.5 35B A3B LoraQwen/Qwen3.5-35B-A3B-Lora Together AI 35B 262K Fair Use (По мере нагрузки серверов) Онлайн Открыть
61 ⚖️ Qwen3.6 35B A3B LoraQwen/Qwen3.6-35B-A3B-Lora Together AI 35B 262K Fair Use (По мере нагрузки серверов) Онлайн Открыть
62 🚀 LLaMA 3.1 70Bllama3.1-70b Cerebras 70B 128K 14 400 req/day · 30 req/min Кэш Открыть
63 ⚖️ Qwen 1.5 14B Chat@cf/qwen/qwen1.5-14b-chat-cp Cloudflare 14B 33K 10 000 req/day Кэш Открыть
64 🚀 Google: Nano Banana Pro (Gemini 3 Pro Image Preview)google/gemini-3-pro-image-preview OrcaRouter ? 66K Бесплатный тариф Онлайн Открыть
65 ⚖️ Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)google/gemini-3.1-flash-image-preview OrcaRouter ? 66K Бесплатный тариф Онлайн Открыть
66 🚀 Codellama 70bmeta/codellama-70b NVIDIA Build 70B 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
67 ⚖️ Codestral 22b Instruct V0.1mistralai/codestral-22b-instruct-v0.1 NVIDIA Build 22B 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
68 🚀 Deepseek V4 Flashdeepseek-ai/deepseek-v4-flash NVIDIA Build ? 131K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
69 🚀 Deepseek V4 Prodeepseek-ai/deepseek-v4-pro NVIDIA Build ? 131K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
70 ⚖️ Granite 34b Code Instructibm/granite-34b-code-instruct NVIDIA Build 34B 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
71 🚀 Jamba 1.5 Large Instructai21labs/jamba-1.5-large-instruct NVIDIA Build ? 262K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
72 🚀 LLAMA 3.1 70b Instructmeta/llama-3.1-70b-instruct NVIDIA Build 70B 131K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
73 ⚖️ LLAMA 3.1 Nemotron 51b Instructnvidia/llama-3.1-nemotron-51b-instruct NVIDIA Build 51B 131K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
74 🚀 LLAMA 3.1 Nemotron 70b Instructnvidia/llama-3.1-nemotron-70b-instruct NVIDIA Build 70B 131K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
75 🚀 LLAMA 3.1 Nemotron Ultra 253b V1nvidia/llama-3.1-nemotron-ultra-253b-v1 NVIDIA Build 253B 131K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
76 🚀 LLAMA 3.2 90b Vision Instructmeta/llama-3.2-90b-vision-instruct NVIDIA Build 90B 131K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
77 🚀 LLAMA 3.3 70b Instructmeta/llama-3.3-70b-instruct NVIDIA Build 70B 131K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
78 ⚖️ LLAMA 3.3 Nemotron Super 49b V1nvidia/llama-3.3-nemotron-super-49b-v1 NVIDIA Build 49B 131K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
79 ⚖️ LLAMA 3.3 Nemotron Super 49b V1.5nvidia/llama-3.3-nemotron-super-49b-v1.5 NVIDIA Build 49B 131K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
80 🚀 Llama2 70bmeta/llama2-70b NVIDIA Build 70B 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
81 🚀 Llama3 Chatqa 1.5 70bnvidia/llama3-chatqa-1.5-70b NVIDIA Build 70B 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
82 🚀 Mistral Largemistralai/mistral-large NVIDIA Build ? 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
83 🚀 Mistral Large 2 Instructmistralai/mistral-large-2-instruct NVIDIA Build ? 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
84 🚀 Mistral Medium 3.5 128bmistralai/mistral-medium-3.5-128b NVIDIA Build 128B 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
85 ⚖️ Mistral Nemo 12b Instructnv-mistralai/mistral-nemo-12b-instruct NVIDIA Build 12B 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
86 ⚖️ Mistral Nemotronmistralai/mistral-nemotron NVIDIA Build ? 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
87 ⚖️ Mixtral 8x22b V0.1mistralai/mixtral-8x22b-v0.1 NVIDIA Build ? 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
88 ⚖️ Nemotron 3 Nano 30b A3bnvidia/nemotron-3-nano-30b-a3b NVIDIA Build 30B 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
89 ⚖️ Nemotron 3 Nano Omni 30b A3b Reasoningnvidia/nemotron-3-nano-omni-30b-a3b-reasoning NVIDIA Build 30B 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
90 🚀 Nemotron 3 Super 120b A12bnvidia/nemotron-3-super-120b-a12b NVIDIA Build 120B 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
91 🚀 Nemotron 3 Ultra 550b A55bnvidia/nemotron-3-ultra-550b-a55b NVIDIA Build 550B 1.0M Free serverless inference for development; limits and model availability may change. Онлайн Открыть
92 🚀 Nemotron 4 340b Instructnvidia/nemotron-4-340b-instruct NVIDIA Build 340B 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
93 ⚖️ Nemotron Nano 12b V2 VLnvidia/nemotron-nano-12b-v2-vl NVIDIA Build 12B 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
94 ⚖️ Nemotron Nano 3 30b A3bnvidia/nemotron-nano-3-30b-a3b NVIDIA Build 30B 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
95 ⚖️ Phi 3 Vision 128k Instructmicrosoft/phi-3-vision-128k-instruct NVIDIA Build ? 131K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
96 ⚖️ Phi 3.5 Moe Instructmicrosoft/phi-3.5-moe-instruct NVIDIA Build ? 33K Free serverless inference for development; limits and model availability may change. Онлайн Открыть
97 ⚖️ Nemotron 3 Nano Omni 30b A3b Reasoning:Freenvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free TokenRouter 30B 33K Free models and promotional access may be time-limited; availability is checked through the Models API. Онлайн Открыть