Free-LLMs
EN

Бесплатные модели для ИИ-агента

Обновлено:

Подборка моделей для автономных и полуавтономных ИИ-агентов: планирование, вызов инструментов, анализ длинного контекста и выполнение многошаговых задач.

Подробнее

В подборку входят сильные reasoning- и instruct-модели. Для надёжного агента дополнительно проверяйте поддержку structured output, function calling и стабильность бесплатных квот у выбранного API-провайдера.

Найдено 111 моделей

Мощность
Модель Мощность Провайдер Параметры Контекст Лимит
1 NVIDIA: Nemotron 3.5 Lightning (free) ⚖️ OpenRouter ? 1.0M Бесплатный тариф Открыть
2 NVIDIA: Nemotron 3.5 Content Safety (free) ⚖️ OpenRouter ? 128K Бесплатный тариф Открыть
3 NVIDIA: Nemotron 3 Ultra (free) 🚀 OpenRouter 550B 1.0M Бесплатный тариф Открыть
4 NVIDIA: Nemotron 3 Nano Omni (free) ⚖️ OpenRouter 30B 256K Бесплатный тариф Открыть
5 NVIDIA: Nemotron 3 Super (free) 🚀 OpenRouter 120B 262K Бесплатный тариф Открыть
6 LLaMA 3.3 70B Versatile 🚀 Groq 70B 128K 1 000 req/day Открыть
7 DeepSeek R1 Distill LLaMA 70B 🚀 Groq 70B 128K 1 000 req/day Открыть
8 Mistral Saba 24B ⚖️ Groq 24B 32K 1 000 req/day Открыть
9 Gemini 2.0 Flash ⚖️ Google Gemini ? 1.0M 1 500 req/day Открыть
10 Gemini 2.0 Flash Lite ⚖️ Google Gemini ? 1.0M 1 500 req/day Открыть
11 Gemini 1.5 Flash ⚖️ Google Gemini ? 1.0M 1 500 req/day Открыть
12 Gemini 1.5 Pro 🚀 Google Gemini ? 2.1M 50 req/day Открыть
13 Mistral Small ⚖️ Mistral AI ? 33K 1 req/min · 500 tok/min Открыть
14 Mistral Nemo ⚖️ Mistral AI ? 131K 1 req/min · 500 tok/min Открыть
15 Mistral Embed ⚖️ Mistral AI ? 8K 1 req/min · 500 tok/min Открыть
16 nim/meta/llama-3.2-90b-vision-instruct 🚀 Together AI 90B 16K Fair Use (По мере нагрузки серверов) Открыть
17 nim/mistralai/mixtral-8x22b-instruct-v01 ⚖️ Together AI ? 16K Fair Use (По мере нагрузки серверов) Открыть
18 nim/meta/llama-3.3-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Открыть
19 nim/nvidia/llama-3.1-nemotron-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Открыть
20 nim/meta/llama-3.1-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Открыть
21 nim/nv-mistralai/mistral-nemo-12b-instruct ⚖️ Together AI 12B 16K Fair Use (По мере нагрузки серверов) Открыть
22 nim/mistralai/mixtral-8x7b-instruct-v01 ⚖️ Together AI ? 16K Fair Use (По мере нагрузки серверов) Открыть
23 nim/nvidia/llama-3.3-nemotron-super-49b-v1 ⚖️ Together AI 49B 16K Fair Use (По мере нагрузки серверов) Открыть
24 Cogito V1 Preview Qwen 32B ⚖️ Together AI 32B 131K Fair Use (По мере нагрузки серверов) Открыть
25 Cogito V1 Preview Qwen 14B ⚖️ Together AI 14B 131K Fair Use (По мере нагрузки серверов) Открыть
26 Cogito V1 Preview Llama 70B 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Открыть
27 Cogito V1 Preview Llama 70B Turbo 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Открыть
28 Meta Llama 3.3 70B Instruct 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Открыть
29 Qwen2.5 32B ⚖️ Together AI 32B 131K Fair Use (По мере нагрузки серверов) Открыть
30 Qwen2.5 72B 🚀 Together AI 72B 131K Fair Use (По мере нагрузки серверов) Открыть
31 Qwen2.5 14B ⚖️ Together AI 14B 131K Fair Use (По мере нагрузки серверов) Открыть
32 Llama 3.1 70B 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Открыть
33 Qwen2.5 32B Instruct ⚖️ Together AI 32B 33K Fair Use (По мере нагрузки серверов) Открыть
34 Llama 3.1 405B 🚀 Together AI 405B 131K Fair Use (По мере нагрузки серверов) Открыть
35 Devstral Small 2505 ⚖️ Together AI ? 131K Fair Use (По мере нагрузки серверов) Открыть
36 Mixtral 8X22b Instruct V0.1 ⚖️ Together AI ? 66K Fair Use (По мере нагрузки серверов) Открыть
37 Qwen3 14B ⚖️ Together AI 14B 2K Fair Use (По мере нагрузки серверов) Открыть
38 Qwen3 30B A3b ⚖️ Together AI 30B 41K Fair Use (По мере нагрузки серверов) Открыть
39 Llama 4 Scout (17Bx16E) ⚖️ Together AI 17B 262K Fair Use (По мере нагрузки серверов) Открыть
40 Magistral Small 2506 ⚖️ Together AI ? 41K Fair Use (По мере нагрузки серверов) Открыть
41 Qwen3 32B ⚖️ Together AI 32B 41K Fair Use (По мере нагрузки серверов) Открыть
42 Qwen3 235B A22b Instruct 2507 Fp8 🚀 Together AI 235B 262K Fair Use (По мере нагрузки серверов) Открыть
43 Qwen3 Coder 30B A3b Instruct ⚖️ Together AI 30B 262K Fair Use (По мере нагрузки серверов) Открыть
44 Qwen3 Next 80B A3b Instruct Fp8 🚀 Together AI 80B ? Fair Use (По мере нагрузки серверов) Открыть
45 Qwen3-VL-235B-A22B-Instruct-FP8 🚀 Together AI 235B 262K Fair Use (По мере нагрузки серверов) Открыть
46 Nvidia Nemotron 3 Nano 30B A3b Bf16 ⚖️ Together AI 30B 262K Fair Use (По мере нагрузки серверов) Открыть
47 Qwen3.5 35B A3b ⚖️ Together AI 35B 262K Fair Use (По мере нагрузки серверов) Открыть
48 Nvidia Nemotron 3 Super 120B A12b Fp8 🚀 Together AI 120B 262K Fair Use (По мере нагрузки серверов) Открыть
49 Deepseek OCR 2 ⚖️ Together AI ? 8K Fair Use (По мере нагрузки серверов) Открыть
50 Qwen3.5 122B A10b Fp8 🚀 Together AI 122B 262K Fair Use (По мере нагрузки серверов) Открыть
51 Qwen3 30B A3B Instruct 2507 Lora ⚖️ Together AI 30B 262K Fair Use (По мере нагрузки серверов) Открыть
52 Nvidia Nemotron 3 Super 120B A12b Bf16 🚀 Together AI 120B 262K Fair Use (По мере нагрузки серверов) Открыть
53 Qwen3.6 35B A3b Fp8 ⚖️ Together AI 35B 262K Fair Use (По мере нагрузки серверов) Открыть
54 Nemotron 3 Nano Omni 30B A3b Reasoning Fp8 ⚖️ Together AI 30B 131K Fair Use (По мере нагрузки серверов) Открыть
55 Llama 3.3 70B Instruct FP8 Lora 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Открыть
56 Mixtral 8x7B Instruct V0.1 FP8 Lora ⚖️ Together AI ? 33K Fair Use (По мере нагрузки серверов) Открыть
57 Llama 4 Scout 17B 16E Instruct Fp8 Lora ⚖️ Together AI 17B 10.5M Fair Use (По мере нагрузки серверов) Открыть
58 Llama 4 Maverick 17B 128E Instruct Nvfp4 ⚖️ Together AI 17B 1.0M Fair Use (По мере нагрузки серверов) Открыть
59 Qwen3.5 35B A3B Lora ⚖️ Together AI 35B 262K Fair Use (По мере нагрузки серверов) Открыть
60 Qwen3.6 35B A3B Lora ⚖️ Together AI 35B 262K Fair Use (По мере нагрузки серверов) Открыть
61 LLaMA 3.1 70B 🚀 Cerebras 70B 128K 14 400 req/day · 30 req/min Открыть
62 Qwen 1.5 14B Chat ⚖️ Cloudflare 14B 33K 10 000 req/day Открыть
63 DeepSeek: DeepSeek V4 Flash (Free) 🚀 OrcaRouter ? ? Бесплатный тариф Открыть
64 Google: Nano Banana Pro (Gemini 3 Pro Image Preview) 🚀 OrcaRouter ? 66K Бесплатный тариф Открыть
65 Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview) ⚖️ OrcaRouter ? 66K Бесплатный тариф Открыть
66 Codellama 70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Открыть
67 Codestral 22b Instruct V0.1 ⚖️ NVIDIA Build 22B ? Free serverless inference for development; limits and model availability may change. Открыть
68 Deepseek V4 Flash 0731 🚀 NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Открыть
69 Granite 34b Code Instruct ⚖️ NVIDIA Build 34B ? Free serverless inference for development; limits and model availability may change. Открыть
70 Jamba 1.5 Large Instruct 🚀 NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Открыть
71 LLAMA 3.1 Nemotron 51b Instruct ⚖️ NVIDIA Build 51B ? Free serverless inference for development; limits and model availability may change. Открыть
72 LLAMA 3.1 Nemotron 70b Instruct 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Открыть
73 LLAMA 3.1 Nemotron Ultra 253b V1 🚀 NVIDIA Build 253B ? Free serverless inference for development; limits and model availability may change. Открыть
74 LLAMA 3.2 90b Vision Instruct 🚀 NVIDIA Build 90B ? Free serverless inference for development; limits and model availability may change. Открыть
75 Llama2 70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Открыть
76 Llama3 Chatqa 1.5 70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Открыть
77 Mistral Large 🚀 NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Открыть
78 Mistral Large 2 Instruct 🚀 NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Открыть
79 Mistral Nemo 12b Instruct ⚖️ NVIDIA Build 12B ? Free serverless inference for development; limits and model availability may change. Открыть
80 Mistral Nemotron ⚖️ NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Открыть
81 Mixtral 8x22b V0.1 ⚖️ NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Открыть
82 Nemotron 3 Nano Omni 30b A3b Reasoning ⚖️ NVIDIA Build 30B ? Free serverless inference for development; limits and model availability may change. Открыть
83 Nemotron 3 Super 120b A12b 🚀 NVIDIA Build 120B ? Free serverless inference for development; limits and model availability may change. Открыть
84 Nemotron 3 Ultra 550b A55b 🚀 NVIDIA Build 550B 1.0M Free serverless inference for development; limits and model availability may change. Открыть
85 Nemotron 3.5 Lightning 30b A3b ⚖️ NVIDIA Build 30B ? Free serverless inference for development; limits and model availability may change. Открыть
86 Nemotron 4 340b Instruct 🚀 NVIDIA Build 340B ? Free serverless inference for development; limits and model availability may change. Открыть
87 Nemotron Nano 3 30b A3b ⚖️ NVIDIA Build 30B ? Free serverless inference for development; limits and model availability may change. Открыть
88 Phi 3 Vision 128k Instruct ⚖️ NVIDIA Build ? 131K Free serverless inference for development; limits and model availability may change. Открыть
89 Phi 3.5 Moe Instruct ⚖️ NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Открыть
90 Nemotron 3 Nano Omni 30b A3b Reasoning:Free ⚖️ TokenRouter 30B ? Free models and promotional access may be time-limited; availability is checked through the Models API. Открыть
91 Deepseek R1 Distill Llama 70b 🚀 UnoRouter 70B 131K No-card free models use shared capacity and per-model limits; availability can change. Открыть
92 Deepseek V4 Flash 🚀 UnoRouter ? 1.0M No-card free models use shared capacity and per-model limits; availability can change. Открыть
93 Gemini 3.5 Flash Lite ⚖️ UnoRouter ? 1.0M No-card free models use shared capacity and per-model limits; availability can change. Открыть
94 Gemini Flash Lite Latest ⚖️ UnoRouter ? 1.0M No-card free models use shared capacity and per-model limits; availability can change. Открыть
95 Llama 3.2 90b Vision 🚀 UnoRouter 90B 128K No-card free models use shared capacity and per-model limits; availability can change. Открыть
96 Llama 4 Maverick 17b 128e Instruct ⚖️ UnoRouter 17B 128K No-card free models use shared capacity and per-model limits; availability can change. Открыть
97 Mistral Large 3 675b 🚀 UnoRouter 675B 256K No-card free models use shared capacity and per-model limits; availability can change. Открыть
98 Mistral Nemotron ⚖️ UnoRouter ? 128K No-card free models use shared capacity and per-model limits; availability can change. Открыть
99 Mistral Small 3.2 ⚖️ UnoRouter ? 131K No-card free models use shared capacity and per-model limits; availability can change. Открыть
100 Nemotron 3 Nano Omni 30b A3b Reasoning ⚖️ UnoRouter 30B 262K No-card free models use shared capacity and per-model limits; availability can change. Открыть
101 Nemotron 3 Super 120b A12b 🚀 UnoRouter 120B 262K No-card free models use shared capacity and per-model limits; availability can change. Открыть
102 Nemotron 3.5 Lightning ⚖️ UnoRouter ? 262K No-card free models use shared capacity and per-model limits; availability can change. Открыть
103 Nemotron 3.5 Lightning 30b A3b ⚖️ UnoRouter 30B 262K No-card free models use shared capacity and per-model limits; availability can change. Открыть
104 Nemotron Nano 12b V2 Vl ⚖️ UnoRouter 12B 131K No-card free models use shared capacity and per-model limits; availability can change. Открыть
105 QWEN Sea Lion V4 32b It ⚖️ UnoRouter 32B 33K No-card free models use shared capacity and per-model limits; availability can change. Открыть
106 QWEN Sea Lion V4.5 27b It ⚖️ UnoRouter 27B 262K No-card free models use shared capacity and per-model limits; availability can change. Открыть
107 Qwen3 Next 80b A3b Instruct 🚀 UnoRouter 80B 131K No-card free models use shared capacity and per-model limits; availability can change. Открыть
108 Qwen3.5 122b A10b 🚀 UnoRouter 122B 262K No-card free models use shared capacity and per-model limits; availability can change. Открыть
109 Qwen3.6 35b A3b ⚖️ UnoRouter 35B 262K No-card free models use shared capacity and per-model limits; availability can change. Открыть
110 Qwen3.8 27b ⚖️ UnoRouter 27B 66K No-card free models use shared capacity and per-model limits; availability can change. Открыть
111 Typhoon V2.5 30b A3b Instruct ⚖️ UnoRouter 30B 131K No-card free models use shared capacity and per-model limits; availability can change. Открыть