Free-LLMs
EN

Llama — бесплатное API

Обновлено:

Открытые модели Meta Llama, доступные бесплатно через облачных провайдеров. От легковесных 8B до мощных 70B+ вариантов.

Подробнее

Список формируется из актуальных ответов API-провайдеров. Одна модель может встречаться несколько раз: это отдельные точки доступа с собственными лимитами, контекстом и правилами бесплатного тарифа. Вложенные страницы моделей имеют постоянные URL и обновляются автоматически.

Найдено 39 моделей

Мощность
Модель Мощность Провайдер Параметры Контекст Лимит
1 LLaMA 3.3 70B Versatile 🚀 Groq 70B 128K 1 000 req/day Открыть
2 LLaMA 3.1 8B Instant Groq 8B 128K 14 400 req/day Открыть
3 DeepSeek R1 Distill LLaMA 70B 🚀 Groq 70B 128K 1 000 req/day Открыть
4 nim/meta/llama-3.2-11b-vision-instruct Together AI 11B 16K Fair Use (По мере нагрузки серверов) Открыть
5 nim/meta/llama-3.2-90b-vision-instruct 🚀 Together AI 90B 16K Fair Use (По мере нагрузки серверов) Открыть
6 nim/meta/llama-3.3-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Открыть
7 nim/nvidia/llama-3.1-nemotron-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Открыть
8 nim/meta/llama-3.1-8b-instruct Together AI 8B 16K Fair Use (По мере нагрузки серверов) Открыть
9 nim/meta/llama-3.1-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Открыть
10 nim/nvidia/llama-3.3-nemotron-super-49b-v1 ⚖️ Together AI 49B 16K Fair Use (По мере нагрузки серверов) Открыть
11 meta-llama/Llama-2-7b-chat-hf Together AI 7B 4K Fair Use (По мере нагрузки серверов) Открыть
12 Cogito V1 Preview Llama 8B Together AI 8B 131K Fair Use (По мере нагрузки серверов) Открыть
13 Cogito V1 Preview Llama 70B 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Открыть
14 Cogito V1 Preview Llama 70B Turbo 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Открыть
15 Meta Llama 3.3 70B Instruct 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Открыть
16 Llama 3.1 70B 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Открыть
17 Llama 3.2 1B Together AI 1B 131K Fair Use (По мере нагрузки серверов) Открыть
18 Llama 3.1 405B 🚀 Together AI 405B 131K Fair Use (По мере нагрузки серверов) Открыть
19 Llama 4 Scout (17Bx16E) ⚖️ Together AI 17B 262K Fair Use (По мере нагрузки серверов) Открыть
20 Meta Llama 3.1 8B Instruct Awq Int4 Together AI 8B 131K Fair Use (По мере нагрузки серверов) Открыть
21 Llama 3.3 70B Instruct FP8 Lora 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Открыть
22 Llama 4 Scout 17B 16E Instruct Fp8 Lora ⚖️ Together AI 17B 10.5M Fair Use (По мере нагрузки серверов) Открыть
23 Llama 4 Maverick 17B 128E Instruct Nvfp4 ⚖️ Together AI 17B 1.0M Fair Use (По мере нагрузки серверов) Открыть
24 LLaMA 3.1 8B Cerebras 8B 128K 14 400 req/day · 30 req/min Открыть
25 LLaMA 3.1 70B 🚀 Cerebras 70B 128K 14 400 req/day · 30 req/min Открыть
26 Llama 3.1 8B Instruct Cloudflare 8B 131K 10 000 req/day Открыть
27 Llama 3.1 8B HuggingFace 8B 128K Fair Use (По мере нагрузки серверов) Открыть
28 Codellama 70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Открыть
29 LLAMA 3.1 Nemotron 51b Instruct ⚖️ NVIDIA Build 51B ? Free serverless inference for development; limits and model availability may change. Открыть
30 LLAMA 3.1 Nemotron 70b Instruct 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Открыть
31 LLAMA 3.1 Nemotron Ultra 253b V1 🚀 NVIDIA Build 253B ? Free serverless inference for development; limits and model availability may change. Открыть
32 LLAMA 3.2 11b Vision Instruct NVIDIA Build 11B ? Free serverless inference for development; limits and model availability may change. Открыть
33 LLAMA 3.2 90b Vision Instruct 🚀 NVIDIA Build 90B ? Free serverless inference for development; limits and model availability may change. Открыть
34 Llama2 70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Открыть
35 Llama3 Chatqa 1.5 70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Открыть
36 Deepseek R1 Distill Llama 70b 🚀 UnoRouter 70B 131K No-card free models use shared capacity and per-model limits; availability can change. Открыть
37 Llama 3.2 11b Vision UnoRouter 11B 128K No-card free models use shared capacity and per-model limits; availability can change. Открыть
38 Llama 3.2 90b Vision 🚀 UnoRouter 90B 128K No-card free models use shared capacity and per-model limits; availability can change. Открыть
39 Llama 4 Maverick 17b 128e Instruct ⚖️ UnoRouter 17B 128K No-card free models use shared capacity and per-model limits; availability can change. Открыть