Llama — бесплатное API
Обновлено:
Открытые модели Meta Llama, доступные бесплатно через облачных провайдеров. От легковесных 8B до мощных 70B+ вариантов.
Подробнее
Список формируется из актуальных ответов API-провайдеров. Одна модель может встречаться несколько раз: это отдельные точки доступа с собственными лимитами, контекстом и правилами бесплатного тарифа. Вложенные страницы моделей имеют постоянные URL и обновляются автоматически.
Найдено 39 моделей
| № | Модель | Мощность | Провайдер | Параметры | Контекст | Лимит | |
|---|---|---|---|---|---|---|---|
| 1 |
LLaMA 3.3 70B Versatile
|
🚀 | Groq | 70B | 128K | 1 000 req/day | Открыть |
| 2 |
LLaMA 3.1 8B Instant
|
⚡ | Groq | 8B | 128K | 14 400 req/day | Открыть |
| 3 |
DeepSeek R1 Distill LLaMA 70B
|
🚀 | Groq | 70B | 128K | 1 000 req/day | Открыть |
| 4 |
nim/meta/llama-3.2-11b-vision-instruct
|
⚡ | Together AI | 11B | 16K | Fair Use (По мере нагрузки серверов) | Открыть |
| 5 |
nim/meta/llama-3.2-90b-vision-instruct
|
🚀 | Together AI | 90B | 16K | Fair Use (По мере нагрузки серверов) | Открыть |
| 6 |
nim/meta/llama-3.3-70b-instruct
|
🚀 | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Открыть |
| 7 |
nim/nvidia/llama-3.1-nemotron-70b-instruct
|
🚀 | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Открыть |
| 8 |
nim/meta/llama-3.1-8b-instruct
|
⚡ | Together AI | 8B | 16K | Fair Use (По мере нагрузки серверов) | Открыть |
| 9 |
nim/meta/llama-3.1-70b-instruct
|
🚀 | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Открыть |
| 10 |
nim/nvidia/llama-3.3-nemotron-super-49b-v1
|
⚖️ | Together AI | 49B | 16K | Fair Use (По мере нагрузки серверов) | Открыть |
| 11 |
meta-llama/Llama-2-7b-chat-hf
|
⚡ | Together AI | 7B | 4K | Fair Use (По мере нагрузки серверов) | Открыть |
| 12 |
Cogito V1 Preview Llama 8B
|
⚡ | Together AI | 8B | 131K | Fair Use (По мере нагрузки серверов) | Открыть |
| 13 |
Cogito V1 Preview Llama 70B
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Открыть |
| 14 |
Cogito V1 Preview Llama 70B Turbo
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Открыть |
| 15 |
Meta Llama 3.3 70B Instruct
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Открыть |
| 16 |
Llama 3.1 70B
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Открыть |
| 17 |
Llama 3.2 1B
|
⚡ | Together AI | 1B | 131K | Fair Use (По мере нагрузки серверов) | Открыть |
| 18 |
Llama 3.1 405B
|
🚀 | Together AI | 405B | 131K | Fair Use (По мере нагрузки серверов) | Открыть |
| 19 |
Llama 4 Scout (17Bx16E)
|
⚖️ | Together AI | 17B | 262K | Fair Use (По мере нагрузки серверов) | Открыть |
| 20 |
Meta Llama 3.1 8B Instruct Awq Int4
|
⚡ | Together AI | 8B | 131K | Fair Use (По мере нагрузки серверов) | Открыть |
| 21 |
Llama 3.3 70B Instruct FP8 Lora
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Открыть |
| 22 |
Llama 4 Scout 17B 16E Instruct Fp8 Lora
|
⚖️ | Together AI | 17B | 10.5M | Fair Use (По мере нагрузки серверов) | Открыть |
| 23 |
Llama 4 Maverick 17B 128E Instruct Nvfp4
|
⚖️ | Together AI | 17B | 1.0M | Fair Use (По мере нагрузки серверов) | Открыть |
| 24 |
LLaMA 3.1 8B
|
⚡ | Cerebras | 8B | 128K | 14 400 req/day · 30 req/min | Открыть |
| 25 |
LLaMA 3.1 70B
|
🚀 | Cerebras | 70B | 128K | 14 400 req/day · 30 req/min | Открыть |
| 26 |
Llama 3.1 8B Instruct
|
⚡ | Cloudflare | 8B | 131K | 10 000 req/day | Открыть |
| 27 |
Llama 3.1 8B
|
⚡ | HuggingFace | 8B | 128K | Fair Use (По мере нагрузки серверов) | Открыть |
| 28 | Codellama 70b | 🚀 | NVIDIA Build | 70B | ? | Free serverless inference for development; limits and model availability may change. | Открыть |
| 29 |
LLAMA 3.1 Nemotron 51b Instruct
|
⚖️ | NVIDIA Build | 51B | ? | Free serverless inference for development; limits and model availability may change. | Открыть |
| 30 |
LLAMA 3.1 Nemotron 70b Instruct
|
🚀 | NVIDIA Build | 70B | ? | Free serverless inference for development; limits and model availability may change. | Открыть |
| 31 |
LLAMA 3.1 Nemotron Ultra 253b V1
|
🚀 | NVIDIA Build | 253B | ? | Free serverless inference for development; limits and model availability may change. | Открыть |
| 32 |
LLAMA 3.2 11b Vision Instruct
|
⚡ | NVIDIA Build | 11B | ? | Free serverless inference for development; limits and model availability may change. | Открыть |
| 33 |
LLAMA 3.2 90b Vision Instruct
|
🚀 | NVIDIA Build | 90B | ? | Free serverless inference for development; limits and model availability may change. | Открыть |
| 34 | Llama2 70b | 🚀 | NVIDIA Build | 70B | ? | Free serverless inference for development; limits and model availability may change. | Открыть |
| 35 |
|
🚀 | NVIDIA Build | 70B | ? | Free serverless inference for development; limits and model availability may change. | Открыть |
| 36 |
Deepseek R1 Distill Llama 70b
|
🚀 | UnoRouter | 70B | 131K | No-card free models use shared capacity and per-model limits; availability can change. | Открыть |
| 37 |
Llama 3.2 11b Vision
|
⚡ | UnoRouter | 11B | 128K | No-card free models use shared capacity and per-model limits; availability can change. | Открыть |
| 38 |
Llama 3.2 90b Vision
|
🚀 | UnoRouter | 90B | 128K | No-card free models use shared capacity and per-model limits; availability can change. | Открыть |
| 39 |
Llama 4 Maverick 17b 128e Instruct
|
⚖️ | UnoRouter | 17B | 128K | No-card free models use shared capacity and per-model limits; availability can change. | Открыть |
LLaMA 3.3 70B Versatile
DeepSeek R1 Distill LLaMA 70B